ローカルテスター、Muse Glimmer 30BをQwenと比較ベンチマーク
r/LocalLLaMAの初期報告では、Muse Glimmer 30Bのコーディング性能は評価が分かれる一方、トークン効率の高さが示された。
なぜ重要か
これらの報告は、30B級のローカルモデルが制約のあるハードウェアでも依然として実用的であることを示している。ただし、コーディングエージェントとしての信頼性は、モデルやワークロードによって大きく変わる。実務者にとって、コミュニティによる検証は、広範なベンチマークスコアだけでは見えにくいトレードオフを明らかにしている。
要点
- 1.Muse Glimmer 30Bのローカルベンチマーク結果は評価が分かれた。
- 2.ユーザーはトークン効率の高さを報告した一方、コーディングの信頼性はQwenより弱いとした。
- 3.Q4量子化版はM5 Pro上で20GBのRAMで動作したと報告された。
LocalLLaMAのユーザーが、Muse Glimmer 30BをQwen 3.6 27B、Gemma4 31B、Deepseek V4 Flash 0731などのモデルと比較した初期のローカルベンチマークと実機テストを公開した。報告では概して、Muse Glimmerは一部のローカル用途で競争力があり、トークン使用効率にも優れるとされた一方、複数のコーディングテストでは実装の信頼性とコード品質でQwen 3.6 27Bを下回った。あるテスターは、48GB搭載のM5 Pro上でMuse GlimmerがQ4量子化版として約20GBのRAMを使い、毎秒17トークン程度で動作したと述べた。
⚡ 今日から使える
Qwen 3.6 27BをMuse Glimmer 30Bに置き換える前に、自分のコーディングとツール利用の評価を実施すべきだ。
出典・一次報道
本記事は以下の媒体の報道を要約し、リンクしています。
- r/LocalLLaMALocal Benchmark : Muse Glimmer 30B vs Qwen 3.6 27B vs Gemma4 31B (and many other models and finetunes)Aug 12, 4:10 AM↗
- r/LocalLLaMATested in Coding: BF16 Muse Glimmer vs BF16 Qwen3.6 27BAug 11, 6:27 PM↗
- r/LocalLLaMA1 Day in and I feel okay saying Muse-Glimmer-30B finally beats 3.6-27B for the size in some use-casesAug 11, 11:25 AM↗
- r/LocalLLaMAMuse glimmer benchmarkAug 11, 5:19 AM↗
- r/LocalLLaMAI made a web-design benchmark for local models (Muse Glimmer 30B vs Qwen 3.6 27b vs Deepseek V4 Flash 0731)Aug 11, 3:52 AM↗
- r/LocalLLaMATested Muse Glimmer locally on coding with OpenCode & agentic workAug 11, 3:51 AM↗
- r/LocalLLaMAPlease Share Your Experience About Muse GlimmerAug 11, 3:02 AM↗
- r/LocalLLaMAIntroducing Muse Glimmer: an open-weight model optimized for always-on local agent workflowsAug 10, 6:14 PM↗
- r/LocalLLaMAMeta open sources new on-device model Muse Glimmer & Muse spark 1.2 also coming soon!Aug 10, 6:10 PM↗
- Hacker NewsMeta Muse Glimmer – open weights 30B local coding modelAug 10, 6:10 PM↗
この記事が役に立ちましたか?次号をメールでお届けします。
関連: モデル
GLM-5.3のベンチマークが開発者の議論を呼ぶ
Artificial AnalysisによるGLM-5.3のベンチマークが、Hacker Newsとr/LocalLLaMAで共有された。
Qwen3.8 27B、Artificial Analysisで52点を記録
RedditとHacker Newsのユーザーが、このモデルのArtificial Analysisでの結果とエージェント性能ランキングに注目した。
「Your AI Slop Bores Me」は人間にチャットボット役を演じさせる
このWebゲームでは、ユーザーが手作業でプロンプトに答え、AI側を演じることでクレジットを獲得する。