摘要
Google 发布 Gemini 3.8 Flash——官方称「最智能的主力模型」,六周内第三个 Flash,速度与成本档位与 3.7 Flash 相同,在软件工程、agentic 任务与专业领域多步推理上提升:HLE-Verified 54.9%;DeepSWE v1.1 上以零头成本胜过多数更大的前沿模型。同期发布的 Gemini 3.8 Flash Cyber 是 Google 最强网络安全模型——前沿级漏洞发现与自动修补——仅通过 Fairwind 计划向受信任防御者(政府机构、关键基础设施运营方、软件维护方)开放:CWE-Bench(Collinear)pass@1 47.2%,对比某领先前沿模型的 47.8% 但成本显著更低;Chrome 正确补丁数是更大商业模型的 2.6 倍;Wiz 内部渗透基准召回率 +7.5-9.7 个百分点、成本低 2.3-5.2 倍;Google Cloud 漏洞研究团队不到 2 小时找到一个关键基础漏洞。3.8 Flash 介绍期定价:输入 $0.75/M、输出 $3.75/M(至 2026-12-31,之后 $1.50/$7.50)。可用范围覆盖 Antigravity、Gemini API、Stitch、Gemini Enterprise 与 AI Pro/Ultra;3.7 Flash 继续服务效率优先场景(3.8 Flash 在复杂任务上耗更多 token,可调低 effort 档)。两模型均按 Frontier Safety Framework 携带 CBRN 与网络攻击防护,并改进了提示注入鲁棒性(Gray Swan 度量)。Gemini 3.8 Flash 已于 9/3 进入 GitHub Copilot。
为什么重要
两件事同时落地:其一,主力档模型在激进介绍价($0.75/$3.75)下升级,重画了 coding agent 路由的性价比线;其二,一周内第二家实验室发布受信任防御者计划门控的 cyber 能力模型(继 Anthropic Mythos 5.1 的 CYP 之后)——前沿 cyber 能力的受控分发正在成为标准做法而非例外。对安全团队,Flash Cyber 的数字(接近前沿的 CWE-Bench、更低成本、2.6 倍的 Chrome 正确补丁)让漏洞发现流水线变得可落地;其他团队切换前应留意复杂任务上 token 用量的上升。
技术细节
| 可用性 | 3.8 Flash:Google Antigravity、Gemini API(AI Studio、Android Studio)、Stitch、Gemini Enterprise、AI Pro/Ultra 消费端;9/3 进 GitHub Copilot;3.7 Flash 继续服务效率优先场景 |
|---|---|
| 定价 | 介绍期输入 $0.75/M、输出 $3.75/M(至 2026-12-31);2027-01-01 起 $1.50/$7.50;3.8 Flash 复杂任务更耗 token,可调低 effort |
| Flash 基准 | HLE-Verified 54.9%;DeepSWE v1.1 以零头成本胜过多数更大前沿模型 |
| Flash Cyber 基准 | CWE-Bench(Collinear)pass@1 47.2%,对比领先前沿 47.8% 且成本显著更低;Chrome 正确补丁为最佳商业模型 2.6 倍;Wiz 召回 +7.5-9.7 个百分点、成本低 2.3-5.2 倍;Google Cloud VR 不到 2 小时找到关键基础漏洞;内部 20 语言漏洞基准成功率超 70% |
| 访问门控 | Fairwind 计划:受信任的政府机构、关键基础设施运营方、软件维护方;比标准模型更宽松的 cyber 防护策略 |
| 安全 | 按 Frontier Safety Framework 携带 CBRN 与网络攻击防护;提示注入鲁棒性改进(Gray Swan) |
标签
geminiflashcybersecurityfairwindpricingcoding-agenttrusted-access