何が起きたのか?
Googleは、コーディング、知識業務、マルチモーダル性能とトークン効率を高めたGemini 3.6 Flashと、大量処理向けの3.5 Flash-Liteを公開しました。
今回の更新は、一つの最高性能モデルよりも用途別ルーティングが重要になったことを示します。複雑な計画は3.6 Flash、反復的な抽出や分類はFlash-Liteと分けられますが、実際の費用は自社のプロンプト長や再試行率を含めて測る必要があります。
なぜ重要なのか?
エージェントの運用費は1回の料金だけでなく、出力トークン、ツール呼び出し回数、処理速度にも左右されるため、大規模自動化の費用構造に直結します。
誰にとって重要か?
AI開発者エージェント運用チーム企業
関連AI
AIZIGOOの見解
速度とベンチマーク値はGoogleおよび評価機関の公表値で、実際の結果はワークロードにより異なります。