Google DeepMind 发布 Gemini 3.8 Flash 与 Gemini 3.8 Flash Cyber:同一核心模型,两种访问边界
Google DeepMind 于 2026 年 9 月 2 日发布 Gemini 3.8 Flash 和 Flash Cyber。两个版本共享同一基础智能,以安全管控而非模型规模区分。3.8 Flash 已开放 API、AI Studio 等渠道,每百万 token 定价 0.75 美元/3.75 美元,优惠价有效期至 2026 年底;Flash Cyber 则在 Fairwind 计划下仅向通过审查的防御方开放。文章解读基准表现、token 换精度的取舍及部署要求。
Google DeepMind 今日发布了 Gemini 3.8 Flash 与 Gemini 3.8 Flash Cyber。这距离 Gemini 3.7 Flash 发布只有三周,也是六周内第三个 Flash 版本。两个版本共享同一套基础智能,该基础模型通过长时间运行的 agentic 循环递归评估下层模型而不断优化。真正区分它们的是安全控制边界,而非模型架构或规模。3.8 Flash 已经通过 Gemini API、Google AI Studio、Antigravity、Android Studio 和 Gemini Enterprise 开放,用户可立即接入生产流量。权重保持封闭,因此没有自托管或本地部署选项。3.8 Flash Cyber 则不提供公开部署渠道,只能通过新设立的 Fairwind 计划逐案审批。
与 3.7 Flash 的关系上,研究团队明确表示 3.8 Flash 基于 3.7 Flash 开发。规格没有变化:上下文窗口为 1048576 token,最大输出为 65536 token,支持文本、图像、音频和视频输入及文本输出。思考级别仍是 LOW/MEDIUM/HIGH,默认 MEDIUM。但对迁移用户有一条关键提示:3.8 Flash 不支持 MINIMAL 级别,若调用该参数会收到 API 验证错误。行为变化才是核心卖点:3.8 Flash 会“更努力地工作”,在复杂任务上执行额外推理步骤并反复调用工具,代价是在高努力档位下消耗更多 token。Google 在开发者指南中坦言,这种设计是用更高 token 消耗换取更好准确率,并建议当算力效率成为硬约束时继续留在 3.7 Flash。这段表述罕见地承认新模型未必是所有工作负载的最佳默认选择。
性能收益方面,在长周期软件工程基准 DeepSWE v1.1 上,Google 称 3.8 Flash 以低得多的成本超越了多数更大规模的前沿模型。它在 HLE-Verified 上取得 54.9%;在 Vals Finance Agent V2 和 Harvey 法律 Agent 基准上相对 3.7 Flash 及其他前沿模型有提升,但公告只给出相对胜出,没有公布绝对得分。
Flash Cyber 则面向防御场景。在标准漏洞发现基准 CyberGym 上,Google 称其达到前沿水平,同时胜过 3.5 Flash Cyber 和明显更大的前沿模型,但未公布绝对数字。有鉴于 CyberGym 主要覆盖 C 和 C++,Google 又用 20 种编程语言的内部基准做了测试,报告发现成功率高于 70%。在由 Collinear 运营的 CWE-Bench 漏洞修复基准上,Flash Cyber 取得 47.2% 的 pass@1,对照的前沿模型为 47.8%。Google 把这描述为“以更低成本实现几近平手”,并将产品定位在帕累托前沿上,而非单纯登顶排行榜。Chrome Security 报告称,它能比最大的商用模型多生成 2.6 倍的正确补丁;Wiz 在内部渗透测试基准上观察到召回率高出 7.5 到 9.7 个百分点,同时成本降低 2.3 到 5.2 倍。Google Cloud 漏洞研究团队用不到两小时就发现了一个关键的基础性漏洞,而类似工作通常需要数月。
为何要限制访问?Google 明确表示,设计优先考虑漏洞修复,而非利用漏洞等攻击能力。Flash Cyber 搭载了相对更宽松的一整套网络安全缓解措施,正因如此,它只提供给受信任的防御方:通过 Fairwind 计划申请的政府机构、关键基础设施运营者和软件维护者。
价格方面,3.8 Flash 延续 3.7 Flash 的定价:每百万输入 token 0.75 美元,每百万输出 token 3.75 美元,优惠价有效期至 2026 年 12 月 31 日。Flash Cyber 没有公开价目表,也不会按价目表销售,只能通过资格审核获得。对于正在评估部署的团队,关键选择在于:如果以准确率为首要目标且能接受更高 token 消耗,3.8 Flash 是可立即使用的选项;如果算力成本最敏感,3.7 Flash 仍是官方推荐。而要获得 Cyber 的防御能力,则必须进入 Fairwind 生态,并接受安全边界而非模型能力作为访问门槛。