AI News HubLIVE
サイト内リライト4 分で読了

Google、Gemini 3.6 Flash、3.5 Flash-Lite、3.5 Flash Cyberをリリース:エージェントワークロード向けのより安価でトークン効率の高いFlash層

Googleは2026年7月21日、Gemini 3.6 Flash、3.5 Flash-Lite、3.5 Flash Cyberの3つの新しいGeminiモデルをリリースしました。3.6 Flashは出力トークンを17%削減し、出力価格を100万トークンあたり7.50ドルに引き下げました。Flash-Liteは毎秒350トークンで動作し、Flash Cyberは脆弱性発見のためにCodeMenderを強化します。フラッグシップの3.5 Proは引き続き遅延しています。

ソースMarkTechPost著者: Asif Razzaq

本番エージェントを構築する開発者には、より高いトークン効率、低レイテンシ、信頼性の高いパフォーマンスが必要です。本日、Googleは3つの新しいGeminiモデルをリリースしました。ラインナップはGemini 3.6 Flash、Gemini 3.5 Flash-Lite、Gemini 3.5 Flash Cyberです。これらはいずれもFlash層に属し、Googleは速度、コスト、そして最大の推論深度ではなく高ボリュームのエージェントワークに合わせて調整しています。

Gemini 3.6 Flash:より良い品質、より少ないトークン、より低い価格

Gemini 3.6 Flashは新しいデフォルトのワークホースです。3.5 Flashをベースに、コーディング、知識作業、マルチモーダルタスクをターゲットとしています。主なポイントは効率です。Artificial Analysis Indexによると、3.6 Flashは3.5 Flashよりも17%少ない出力トークンを使用します。DatacurveのDeepSWEベンチマークでは、Googleは最大65%の削減を報告しています。このモデルは、マルチステップワークフローあたりの推論ステップとツール呼び出しも削減します。

価格設定は効率とともに低下します。Gemini 3.6 Flashの価格は、入力トークン100万あたり1.50ドル、出力トークン100万あたり7.50ドルです。出力価格は以前の3.5 Flashの9.00ドルから低下しました。低い冗長性と低い出力価格により、エージェントタスクあたりの総コストが削減されます。

品質向上は効率向上に伴います。DeepSWEでは、3.6 Flashは49%に対し3.5 Flashは37%です。MLE Benchでは63.9%対49.7%に達します。OSWorld-Verifiedでは83.0%対78.4%です。知識作業ベンチマークのGDPval-AA v2では1421対1349です。コンピューター使用は、Gemini APIおよびGemini Enterpriseを通じてクライアントサイドの組み込みツールとなりました。初期顧客であるHebbiaやHarveyは、文書解析、チャートやデータ分析、レポート作成における利点を挙げています。

Googleは3.6 Flashに強化されたフロンティアセーフティ対策を搭載しています。これには、化学、生物、放射性、核(CBRN)およびサイバー攻撃の悪用が含まれます。詳細は3.6 Flashモデルカードに記載されています。

以下のインタラクティブな説明ツールでは、各モデルを前世代と比較し、自分のボリュームでトークンコストを見積もることができます。

Gemini 3.5 Flash-Lite:3.5ラインで最速のモデル

Gemini 3.5 Flash-Liteは、低レイテンシと高スループットのジョブに焦点を当てています。ターゲットユースケースはエージェント検索や文書処理です。Artificial Analysisの測定によると、毎秒350出力トークンで動作します。価格は入力トークン100万あたり0.30ドル、出力トークン100万あたり2.50ドルです。

このモデルは以前の3.1 Flash-Liteを大きく上回っています。Terminal-Bench 2.1では54%対31%です。長文脈ベンチマークのGDM-MRCR v2では72.2%対60.1%です。GDPval-AA v2では1140対642です。注目すべきは、Flash-Liteが一部の評価で古い3 Flashも凌駕していることです。SWE-Bench Proで54.2%対49.6%、OSWorld-Verifiedで74.0%対65.1%とリードしています。

Flash-Liteは設定可能な思考レベル(最小、低、高)を提供します。開発者は高ボリュームタスクに対して低コスト・低レイテンシの実行を優先できます。また、マルチステップのサブエージェントワークロードにはより高い思考レベルを使用できます。コンピューター使用もここでは組み込みツールです。

Gemini 3.5 Flash Cyber in CodeMender:バグを見つけて修正する安価なエージェント

Gemini 3.5 Flash Cyberは最も専門的なリリースです。3.5 Flashをベースに、ソフトウェアの脆弱性を発見、検証、修正するために微調整されています。設計の前提は探索空間問題です。深い欠陥を見つけるには、膨大な実行探索空間を探索する必要があります。単一の大規模モデルへの単一呼び出しはボトルネックになります。

解決策は、安価なモデルを何度も呼び出すことです。GoogleのコードセキュリティエージェントCodeMender内部では、複数の3.5 Flash Cyberエージェントが並行して実行されます。CodeMenderはモデルを最大5回呼び出し、サブエージェントの結果を1つのレポートにマージします。CyberGymベンチマークでは、この設定ははるかに大きなモデルと競争力のあるパフォーマンスに達します。

内部評価は顕著です。GoogleのBig Sleep評価では、Flash Cyberはメインラインの3.5 Flashと3.6 Flashを大幅に上回りました。V8 JavaScriptエンジンでは、固定呼び出し回数で55件のユニークな確認済み問題を発見しました。これはメインラインの3.5 Flashの47件、Claude Opus 4.6の36件と比較されます。他の2つのモデルが見逃した10件の問題をキャッチしました。ある実際のテストでは、GoogleのCloud Vulnerability Researchチームがこれを使用して、公共APIのリモートコード実行の欠陥を2時間以内に発見しました。

https://blog.google/innovation-and-ai/models-and-research/gemini-models/gemini-3-6-flash-3-5-flash-lite-3-5-flash-cyber/

コミュニティの反応

反応は予想通り分かれました。開発者は価格と効率を歓迎しました。遅延したフラッグシップが最も大きな批判を集めました。Hacker Newsでは、Googleは確実にプロビジョニングできない容量を過剰に販売していると主張する声があり、イライラする実践的なコーディングセッションを引用していました。制限されたFlash Cyberのリリースは、自動化されたエクスプロイト発見ツールを誰が保持すべきかというデュアルユースの議論を引き起こしました。

以下のダッシュボードは、プラットフォーム別に議論を集約したものです。これは定性的な編集総合であり、スクレイピングされたデータセットではなく、方法ノートが埋め込まれています。

可用性

Gemini 3.6 Flashと3.5 Flash-Liteは本日から利用可能です。開発者はGoogle AI StudioやAndroid Studioを介してGemini APIからアクセスできます。Gemini 3.6 FlashはGoogle Antigravityでも利用可能で、GitHub Copilotでも展開されています。エンタープライズユーザーはGemini Enterprise Agentプラットフォームで両方のモデルを入手でき、3.6 FlashはGemini Enterpriseアプリでも利用できます。すべてのユーザーはGeminiアプリから使用でき、3.5 Flash-LiteはGoogle検索で展開されています。開発者ガイドから始めてください。

主なポイント

Gemini 3.6 Flashは出力トークンを17%(DeepSWEでは最大65%)削減し、出力価格を100万トークンあたり9.00ドルから7.50ドルに引き下げ。

Gemini 3.5 Flash-Liteは毎秒350トークンで動作し、価格は入力0.30ドル/出力2.50ドル(100万トークンあたり)。SWE-Bench ProとOSWorld-Verifiedで古い3 Flashを凌駕。

Gemini 3.5 Flash Cyberを搭載したCodeMenderは低コストのマルチエージェントスキャンにより、V8で55件のユニークな問題を発見(3.5 Flashは47件、Opus 4.6は36件)。

Flash Cyberはデュアルユースリスクのため、政府および信頼できるパートナー限定のパイロット版として提供。

この記事はMarkTechPostに最初に掲載されました。