Google Gemini 3.6 Flash、エンタープライズエージェントのトークンコスト削減を目指す
Googleは、エンタープライズAIエージェントのレイテンシとトークンコストを削減するために、Gemini 3.6 Flashおよび3.5 Flash-Liteをリリースしました。3.6 Flashは複数のベンチマークで性能向上を示し、3.5 Flash-Liteは高スループット・低レイテンシのシナリオに特化しています。さらに、サイバーセキュリティ向けの3.5 Flash Cyberモデルも提供され、クライアント側コンピュータ使用ツールが統合されました。
Googleは、エンタープライズAIエージェント向けにGemini 3.6 Flashと3.5 Flash-Liteを発表しました。これらの新しいモデルは、レイテンシとトークンコストの大幅な削減を実現し、生産環境での自律ソフトウェアエージェントの運用効率を最適化します。
エンタープライズ向けの自律エージェントの経済性は、モデルがマルチステップタスクを効率的に実行する能力に依存しますが、生成されるトークンごとにコストと遅延が発生します。Googleの新モデル群はこのトレードオフを解消することを目指しています。
Gemini 3.6 Flashはコーディングとマルチモーダル推論に特化しており、複数のベンチマークで顕著な性能向上を示しています。Googleの開発文書によると、Artificial Analysis Indexでの出力トークンは前世代の3.5 Flashより17%少なく、Datacurve DeepSWEなどの特定テストでは最大65%の削減を達成。価格は入力トークンが100万個あたり1.50ドル、出力トークンが100万個あたり7.50ドルで、連続的な推論ループに適しています。
性能面では、3.6 FlashはDeepSWEベンチマークで49%の成功率(前世代37%)、MLE Benchで49.7%から63.9%に向上、実世界の知識作業を測定するGDPval-AA v2テストでは1349から1421にスコアアップしました。
企業ユーザーはすでに活用を開始しています。Figmaは3.6 Flashをプロトタイピングインフラに統合し、製品エンジニアリングディレクターのMatt Colyer氏によると、品質を落とさずに設計イテレーションを高速化。法律テクノロジープラットフォームのHarveyや研究ツールのHebbiaは、財務書類の解析やチャート読み取り、レポート草案作成に利用しています。
Googleはまた、Gemini APIおよびエンタープライズプラットフォームにクライアント側コンピュータ使用ツールを統合し、モデルがOSを直接操作できるようにしました。OSWorld-Verifiedスコアは78.4%から83.0%に上昇し、化学・生物・放射線・核の悪用に対する安全性も向上。
高スループットのバックグラウンドエージェント向けには、3.5 Flash-Liteが低コストな選択肢を提供します。Artificial Analysis Indexで毎秒350出力トークンを記録し、3.5シリーズ最速。価格は入力100万トークンあたり0.30ドル、出力100万トークンあたり2.50ドルで、単純なサブエージェントタスクに最適です。長文脈テストGDM-MRCR v2では成功率72.2%(前世代60.1%)、GDPval-AA v2スコアは642から1140に倍増。
さらに、脆弱性の検証と修復に特化した3.5 Flash Cyberモデルが提供されます。CyberGymベンチマークで最先端モデルに匹敵する性能を示すものの、具体的な数字は非公開。政府および認定パートナー向けのパイロットプログラムに限定され、悪用防止のため、GoogleのCodeMenderセキュリティエージェント内で複数のインスタンスが相互検証を行います。
これらの新モデルはGemini API、Google AI Studio、Android Studio、またはGemini Enterprise Agent Platformを通じてアクセス可能。消費者はGeminiアプリでも利用でき、3.5 Flash-LiteはGoogle検索にも展開中です。Googleはまた、3.5 Proがパートナーテスト中であり、次世代Gemini 4アーキテクチャの事前トレーニングが進行中であると述べています。