モデルNEW MODEL

Google、Gemini 3.6 Flashと3.5 Flash-Liteを公開―エージェント効率競争へ

Googleは、コーディング、知識業務、マルチモーダル性能とトークン効率を高めたGemini 3.6 Flashと、大量処理向けの3.5 Flash-Liteを公開しました。

2026/07/221 件の情報源を確認
クイック要約
  • Googleは、Artificial Analysis基準で3.6 Flashの出力トークンが3.5 Flashより17%少ないとしています。
  • 3.6 Flashは入力100万トークン当たり1.50ドル、出力100万トークン当たり7.50ドルです。
  • 3.5 Flash-Liteは毎秒350出力トークン、入力0.30ドル・出力2.50ドルを掲げています。
WHAT HAPPENED

何が起きたのか?

Googleは、コーディング、知識業務、マルチモーダル性能とトークン効率を高めたGemini 3.6 Flashと、大量処理向けの3.5 Flash-Liteを公開しました。

今回の更新は、一つの最高性能モデルよりも用途別ルーティングが重要になったことを示します。複雑な計画は3.6 Flash、反復的な抽出や分類はFlash-Liteと分けられますが、実際の費用は自社のプロンプト長や再試行率を含めて測る必要があります。

WHY IT MATTERS

なぜ重要なのか?

エージェントの運用費は1回の料金だけでなく、出力トークン、ツール呼び出し回数、処理速度にも左右されるため、大規模自動化の費用構造に直結します。

WHO SHOULD CARE

誰にとって重要か?

AI開発者エージェント運用チーム企業
RELATED AI

関連AI

AIZIGOO VIEW

AIZIGOOの見解

速度とベンチマーク値はGoogleおよび評価機関の公表値で、実際の結果はワークロードにより異なります。