ローカルエージェント向け30B
Metaは8月10日、Muse Glimmer 30Bを公開しました。モデルカードは約296億パラメータのdense causal transformer、約18億のperception encoder、131,072トークン超の文脈、テキスト・画像入力とテキスト出力を記載します。ツール利用、多段階推論、失敗回復、エージェント作業を主用途とします。
Apache 2.0で、Transformers、llama.cpp、vLLMに初日対応しました。Metaは約4bit量子化で言語モデルを20GB未満にし、24GB・32GB環境に収められると説明しますが、実際のメモリと速度は文脈、KVキャッシュ、画像、ランタイムで変わります。
ベンチマークの限界
MCP AtlasやSWE-Bench Proなどの表はMeta報告値です。項目ごとにMuse、Gemma4、Qwen3.6の首位が異なり、万能な一位を示しません。モデルカードの基本対応はテキスト・画像入力であり、動画デモや外部拡張と区別すべきです。
利用前の確認
ローカル文書・画面理解や機密作業の候補ですが、30Bには相応の運用能力が必要です。入力権利、ツール権限、プロンプトインジェクション、自社作業の成功率を別途検証してください。