谷歌于当地时间9月2日推出Gemini 3.8 Flash Cyber模型,用于代码安全防护。这一模型通过Fairwind计划向首批受信任的安全防护团队开放,并以漏洞修复为优先方向。谷歌表示,其目标是让安全防御方获得专业能力,因此将漏洞修复置于漏洞利用等攻击性能力之上。

谷歌推出Gemini 3.8 Flash Cyber模型,专注代码安全与漏洞修复

在行业权威漏洞挖掘基准CyberGym中,Gemini 3.8 Flash Cyber的自主漏洞挖掘能力超过前代3.5 Flash Cyber,也优于多款体量更大的前沿模型。谷歌内部使用涉及20种编程语言的复杂代码工程进行评测,该模型对各类安全漏洞的挖掘成功率超过70%。在CWE-Bench测试中,该模型处于帕累托前沿:首选正确率(Pass@1)达到47.2%,接近顶尖前沿模型的47.8%,调用成本却低得多。

谷歌对Gemini 3.8 Flash内置了防止CBRN及网络攻击方向滥用风险的安全机制。相比之下,Gemini 3.8 Flash Cyber适度放宽了网络安全部分的策略拦截,只向具备合规需求、需要更完整网络攻防能力的团队开放。

目前,这款模型已在谷歌内部全面部署用于代码安全防护。Chrome安全团队的评估显示,该模型为Chrome浏览器漏洞生成有效修复补丁的数量达到顶尖商业模型的2.6倍,而这些商业模型的参数规模远超它。安全机构Wiz在其内部评测中发现,相比其他顶尖前沿模型,Gemini 3.8 Flash Cyber的召回率提升7.5%-9.7%,调用成本则降至后者的约1/5.2到1/2.3。谷歌云漏洞研究团队还利用该模型在不到两小时内找出了一处严重的底层架构漏洞,同类漏洞排查过去通常需要数月。