2026年7月21日、GoogleはAIエージェント向けに最適化した新モデル「Gemini 3.6 Flash」および「3.5 Flash-Lite」を発表した。これにより、トークン効率の向上と低コスト化が実現し、開発者はより効率的なワークフローを構築できるようになる。
トークン効率とコスト削減を実現
Googleは2026年7月21日、生産環境でのAIエージェント利用を念頭に置いた新モデル「Gemini 3.6 Flash」と高速低価格モデル「3.5 Flash-Lite」を発表した。3.6 Flashは前世代比で出力トークン使用量が最大65%削減され、コストも低下する。また、コーディング能力やマルチモーダル処理の精度が向上し、セキュリティ面でも強化された安全性 safeguards が実装されている。
高速処理と低価格によるスケーラビリティ
3.5 Flash-Liteは1秒あたり350トークンの出力速度を達成し、高いスループットが求められるエージェント検索やドキュメント処理に適している。前世代比で品質も向上しており、低コストかつ高性能な組み合わせにより、大量の処理タスクを効率的に実行できる。
実務への影響と提供条件
3.6 FlashはGemini API、Google AI Studio、Android Studio、Google Antigravityを通じて開発者に提供される。エンタープライズ向けにはGemini Enterprise Agent Platformで利用可能だ。また、セキュリティ特化型モデル「3.5 Flash Cyber」はCodeMenderを介して政府や信頼できるパートナー限定でパイロットプログラムとして展開される予定である。
残る論点
新モデルの詳細なベンチマーク結果や、他のモデルとの比較データに関する具体的な数値については、リリース元で確認できるものの、すべてのユースケースでのパフォーマンス保証までは明記されていない。また、3.5 Proの正式公開時期についても「準備ができ次第」とのみ述べられている。
