AI News HubLIVE
サイト内リライト2 分で読了

Gemini 3.7 Flash:知能とタスクあたり時間のパレート最前線に

Google DeepMindがGemini 3.7 Flashを発表。Artificial Analysis Intelligence Indexで前世代比4ポイント向上の56を記録し、GPT-5.6 Terraより40%高速で、知能とタスクあたり時間のパレート最前線に到達。

ソースHacker News AI著者: frozenseven

Google DeepMindは、Gemini Flashシリーズの最新モデル「Gemini 3.7 Flash」を公開しました。3カ月の間に発表される3番目のFlashモデルとなります。Artificial AnalysisのIntelligence Indexでは、Gemini 3.7 Flash(高推論)は56点を獲得し、GPT-5.6 Terra(最高推論、57点)やMuse Spark 1.2(極高推論、57点)に次ぐ結果となりました。これはGemini 3.6 Flashから4ポイントの改善です。

公開に先立ち、当社は高・中・低の3つの推論レベルでベンチマークを実施しました。高推論モードでは、平均タスクあたり時間は1.7分で、GPT-5.6 Terra(最高推論)より40%高速です。この性能により、本モデルは「知能 vs タスクあたり時間」のパレート最前線に位置づけられ、GoogleがFlashシリーズ全体で重視するスピード戦略を裏付けるものとなりました。

Intelligence Indexの内訳を見ると、Gemini 3.7 Flash(高推論)の56点は、主にエージェント系評価の向上によるものです。Tau3 Bankingは+3ポイント、Terminal-Bench v2.1は+8ポイント、GDPval-AA v2は+103 Elo改善しました。中推論モードでは53点でDeepSeek V4 Pro 0813(最高、53点)やGLM-5.2(最高、53点)に並び、低推論モードでは51点でDeepSeek V4 Flash 0731(最高、52点)にわずかに及びません。

出力速度は毎秒約340トークンで、GPT-5.6 TerraやGLM-5.2の約3倍です。高推論モードの平均タスクあたり時間1.7分とあわせて、知能と速度の両面でパレート最前線を達成しました。価格設定はGemini 3.6 Flashと同じく、入力/出力100万トークンあたり1.50/7.50ドルですが、年末までは0.75/3.75ドルの割引価格を提供します。割引価格では、高推論モードのタスクあたりコストは0.40ドルで、Gemini 3.6 Flashより30%低く、Muse Spark 1.2(極高、0.40ドル)に並びます。中推論モードでは0.26ドルとなり、「知能 vs タスクあたりコスト」のパレート最前線にも入ります。

専用ベンチマークでは、スプレッドシートや文書に関する複雑な質問に答える能力を測るAA-AnalystAgentで、Gemini 3.7 Flash(高推論)はpass^5スコア60%と最高を記録し、Claude Opus 5(最高、54%)やFable 5(49%)を上回りました。SaaS環境でのエージェント能力を評価するAutomationBench-AAでは62.7%を獲得し、Kimi K3(最高、53%)やGPT-5.6 Sol(最高、51.2%)をリードしています。エージェント型知識労働の評価であるAA-Briefcaseでは1132 Elo(前世代比+169)でMinimax-M3をわずかに上回り、GDPval-AA v2では1525点(+103)でGLM 5.2(最高、1506)やDeepSeek V4 Flash 0731(最高、1558)と同水準です。

モデル仕様は、コンテキストウィンドウが100万トークンでGemini 3.6 Flashから据え置き、テキスト・画像・動画・音声の入力に対応し、出力はテキストです。標準価格は入力/出力100万トークンあたり1.50/7.50ドル、年末までの割引価格は0.75/3.75ドルで、キャッシュ入力トークンには引き続き90%の割引が適用されます。