Gemini 3.8 Flash Cyber:Google的AI网络安全利剑,2小时挖出需数月才能发现的关键漏洞
9月2日,Google正式发布Gemini 3.8 Flash及其网络安全专用变体——Gemini 3.8 Flash Cyber。本文基于Google官方博客、9to5Google等多家媒体转述整理。
一句话先说结论
Google在9月2日发布Gemini 3.8 Flash,同时推出网络安全专用变体Gemini 3.8 Flash Cyber。后者只能通过Fairwind计划向政府机构和关键基础设施运营方开放,能在2小时内发现一个通常需要数月研究的基础漏洞,生成的正确漏洞补丁数是其他更大商业模型的2.6倍。
这是一次什么样的更新?
这是Google在六周内发布的第三个Flash模型(3.6 Flash → 3.7 Flash → 3.8 Flash),显示Google在快速迭代策略上的决心。与之前的版本相比,3.8 Flash的核心提升在于:
- 长期软件工程能力:在DeepSWE v1.1(长周期软件工程任务)上,超越多数更大参数的前模型,以更低成本自主解决复杂工程问题
- 多步骤推理:HLE-Verified基准得分54.9%,覆盖STEM、人文和专业领域
- 专业领域表现:在Vals Finance Agent V2和Harvey's Legal Agent Benchmark上超越3.7 Flash和其他前模型
- 工作更努力:Google称3.8 Flash在复杂任务上会执行更多推理步骤、调用更多工具迭代,以追求更高性能
基于相同底座的网络安全专用变体,通过Google的Fairwind Program向"可信防御者"开放——包括政府机构、关键基础设施运营方和软件维护者。普通开发者和企业暂时无法直接获取API权限。
实测成果:比人类安全研究员快多少?
Google和第三方安全公司分享了多项实测数据:
| 场景 | 成果 | 对比 |
|---|---|---|
| Chrome漏洞修补 | 生成正确补丁数是竞品的2.6倍 | Chrome安全团队实测 |
| 渗透测试召回率 | +7.5%~9.7% | Wiz内部基准,成本降低2.3-5.2倍 |
| 基础漏洞发现 | 2小时完成 | Google云漏洞研究团队,同类研究通常需数月 |
| CyberGym漏洞发现 | 达到前沿水平 | 超越3.5 Flash Cyber及更大前模型 |
| CWE-Bench补丁能力 | pass@1达47.2% | 接近领先前模型47.8%,成本显著更低 |
定价与接入方式
标准版定价:$0.75/1M输入tokens、$3.75/1M输出tokens(促销价,有效期至2026年12月31日)
接入渠道:
- 普通用户:Google AI Pro/Ultra订阅可在Gemini App中使用
- 开发者:通过Gemini API、AI Studio、Android Studio接入
- 企业用户:通过Gemini Enterprise接入
- Cyber变体:仅通过Fairwind Plan申请,面向政府和安全机构
客观边界:三个需要注意的点
背景:Google为什么这么急?
六周连发三个Flash模型,背后是Google在AI竞赛中的紧迫感。自2026年初发布Gemini Pro以来,Google在旗舰级模型上落后于OpenAI的GPT系列和Anthropic的Claude系列。Flash系列的快速迭代策略,旨在通过高频更新保持竞争力,同时用更低价格吸引开发者和企业用户。
Fairwind Program是Google新的安全合作伙伴计划,旨在与受信任的组织共享前沿安全技术。这也反映出Google对AI安全风险的重视——即使是网络安全工具,也需要在"可信防御者"范围内共享。
对谁有用?
适合:
- 需要快速迭代、长周期软件工程任务的开发团队
- 关注成本和性价比的企业用户(促销期内价格极具竞争力)
- 政府机构和关键基础设施运营方(可申请Cyber变体)
不适合:
- 依赖computer use能力的用户(GPT-6 Astra更强)
- 无法通过Fairwind审核的安全团队(Cyber变体无法直接使用)
- 对最新漏洞和攻击模式有实时需求的企业(知识截止有延迟)
本文由加装AI助手整理发布 | 基于Google官方博客、9to5Google等多家媒体转述整理