AI News · AI新情报

谷歌发布 Gemini 3.8 Flash 与 3.8 Flash Cyber:6 周内第三款 Flash,主打长程编程与自动修复漏洞

核心摘要: 谷歌于 9 月 1 日推出 Gemini 3.8 Flash 与 3.8 Flash Cyber,这是六周内的第三款 Flash 模型。前者主打长程软件工程、智能体任务与专业多步推理,价格与 3.7 Flash 持平(输入每百万 0.

谷歌发布 Gemini 3.8 Flash 与 3.8 Flash Cyber:6 周内第三款 Flash,主打长程编程与自动修复漏洞
AI辅助整理:本文基于下方列出的公开原始来源改写,不代替原文。

核心摘要: 谷歌于 9 月 1 日推出 Gemini 3.8 Flash 与 3.8 Flash Cyber,这是六周内的第三款 Flash 模型。前者主打长程软件工程、智能体任务与专业多步推理,价格与 3.7 Flash 持平(输入每百万 0.75 美元);后者面向网络安全防御,具备自主发现漏洞与自动打补丁能力,仅通过新的 Fairwind 项目向受信任的防御方提供。开发者与 Gemini Enterprise 用户即日起可用。

业务背景

模型竞争正从“堆更大”转向“在成本和效果间找最优解”。谷歌把 Gemini 3.8 做成 Flash 的快速迭代路线——六周内连发三款,目的是让企业能用低价模型承担长程编程与自主智能体任务,而不必每次都上最高阶、最高价的旗舰。

产品亮点与落地方式

本次发布两个变体:3.8 Flash 面向软件工程、智能体与专业多步推理,保持 3.7 的入门价(输入 0.75 美元/百万 token),开放给 API、AI Studio、Android Studio、Gemini 应用与 Gemini Enterprise。

3.8 Flash Cyber 聚焦漏洞发现与自动打补丁,官方明确“防御优先、不主攻利用”,仅通过 Fairwind 项目向受信任的政府与关键基础设施机构、软件维护方开放。两者共享同一基础能力,靠长循环自我评估迭代驱动提升。

实施步骤参考

业务侧:先在 API/Antigravity 上跑一个真实的编码或智能体任务,对比 3.7 与 3.8 的质量和 token 消耗;对成本敏感场景下调 effort 档位。

专业领域:针对财务分析、法务检索等场景做定向评测,看是否达到可用标准。

安全侧:符合准入条件者申请 Fairwind,在漏洞发现、自动补丁环节试点,并设定“补丁必须人工复核”的闸门。

结果证据与边界

所有数字均出自谷歌官方博客,为厂商自述,需独立验证后再作决策依据。已披露的包括 HLE-Verified 54.9%、CWE-Bench pass@1 47.2%、跨 20 语言漏洞发现成功率超 70%,以及 Chrome 安全团队补丁产出为更大商用模型的 2.6 倍等个案。

边界:多数为内部评测或单一团队案例,不代表所有企业代码库都能复现;3.8 Flash Cyber 仅限受信任防御方使用,普通企业拿不到完整能力。

可复制动作

可把“低成本模型 + 受控试点”当作常态选型方法:先用企业自身数据建立小评测集,对比价格相近的模型,再决定是否投入长程自动化。

对涉及代码变更或漏洞修补的场景,无论模型多强都保留人工确认与审计留痕。

证据与边界

  • 所有性能数据均来自谷歌官方博客自述评测,未经独立第三方验证。
  • 官方披露 HLE-Verified 54.9%、CWE-Bench pass@1 47.2%、跨 20 语言漏洞发现成功率超 70%。
  • Chrome 安全团队补丁产出为更大商用模型的 2.6 倍,属谷歌内部个案。
  • 3.8 Flash Cyber 仅通过 Fairwind 项目向受信任防御方提供,普通企业无法直接获取。

企业今天可以做什么

企业可按两条线跟进:业务自动化线——把 Gemini 3.8 Flash 接入 Gemini API、Antigravity 或 Gemini Enterprise,在成本敏感的长任务上小步试点,用“低 effort”档控制 token 开销;安全防御线——若符合 Fairwind 准入条件(政府、关键基础设施、软件维护方等),可申请 3.8 Flash Cyber,在漏洞发现与自动打补丁环节做试点,并始终保留人工复核关键变更。两类试点都应先跑通“评测分 ≠ 企业收益”的验证,再决定放量。

资料来源

公众号原题:Introducing Gemini 3.8 Flash and 3.8 Flash Cyber | blog.google · 查看公众号原文

你的企业,AI最该先改哪一段?

带着一个真实业务问题,先做一次增长诊断。

获取增长诊断