AI辅助整理:本文基于下方列出的公开原始来源改写,不代替原文。
核心摘要: 谷歌于 9 月 1 日推出 Gemini 3.8 Flash 与 3.8 Flash Cyber,这是六周内的第三款 Flash 模型。前者主打长程软件工程、智能体任务与专业多步推理,价格与 3.7 Flash 持平(输入每百万 0.75 美元);后者面向网络安全防御,具备自主发现漏洞与自动打补丁能力,仅通过新的 Fairwind 项目向受信任的防御方提供。开发者与 Gemini Enterprise 用户即日起可用。
业务背景
模型竞争正从“堆更大”转向“在成本和效果间找最优解”。谷歌把 Gemini 3.8 做成 Flash 的快速迭代路线——六周内连发三款,目的是让企业能用低价模型承担长程编程与自主智能体任务,而不必每次都上最高阶、最高价的旗舰。
产品亮点与落地方式
本次发布两个变体:3.8 Flash 面向软件工程、智能体与专业多步推理,保持 3.7 的入门价(输入 0.75 美元/百万 token),开放给 API、AI Studio、Android Studio、Gemini 应用与 Gemini Enterprise。
3.8 Flash Cyber 聚焦漏洞发现与自动打补丁,官方明确“防御优先、不主攻利用”,仅通过 Fairwind 项目向受信任的政府与关键基础设施机构、软件维护方开放。两者共享同一基础能力,靠长循环自我评估迭代驱动提升。
实施步骤参考
业务侧:先在 API/Antigravity 上跑一个真实的编码或智能体任务,对比 3.7 与 3.8 的质量和 token 消耗;对成本敏感场景下调 effort 档位。
专业领域:针对财务分析、法务检索等场景做定向评测,看是否达到可用标准。
安全侧:符合准入条件者申请 Fairwind,在漏洞发现、自动补丁环节试点,并设定“补丁必须人工复核”的闸门。
结果证据与边界
所有数字均出自谷歌官方博客,为厂商自述,需独立验证后再作决策依据。已披露的包括 HLE-Verified 54.9%、CWE-Bench pass@1 47.2%、跨 20 语言漏洞发现成功率超 70%,以及 Chrome 安全团队补丁产出为更大商用模型的 2.6 倍等个案。
边界:多数为内部评测或单一团队案例,不代表所有企业代码库都能复现;3.8 Flash Cyber 仅限受信任防御方使用,普通企业拿不到完整能力。
可复制动作
可把“低成本模型 + 受控试点”当作常态选型方法:先用企业自身数据建立小评测集,对比价格相近的模型,再决定是否投入长程自动化。
对涉及代码变更或漏洞修补的场景,无论模型多强都保留人工确认与审计留痕。
证据与边界
- 所有性能数据均来自谷歌官方博客自述评测,未经独立第三方验证。
- 官方披露 HLE-Verified 54.9%、CWE-Bench pass@1 47.2%、跨 20 语言漏洞发现成功率超 70%。
- Chrome 安全团队补丁产出为更大商用模型的 2.6 倍,属谷歌内部个案。
- 3.8 Flash Cyber 仅通过 Fairwind 项目向受信任防御方提供,普通企业无法直接获取。
企业今天可以做什么
企业可按两条线跟进:业务自动化线——把 Gemini 3.8 Flash 接入 Gemini API、Antigravity 或 Gemini Enterprise,在成本敏感的长任务上小步试点,用“低 effort”档控制 token 开销;安全防御线——若符合 Fairwind 准入条件(政府、关键基础设施、软件维护方等),可申请 3.8 Flash Cyber,在漏洞发现与自动打补丁环节做试点,并始终保留人工复核关键变更。两类试点都应先跑通“评测分 ≠ 企业收益”的验证,再决定放量。