🌀 AIBB-Flywheel

新闻数据飞轮
← 返回文章列表
ithome 科技 采集 2026-09-02T22:07:46+00:00

谷歌推出Gemini 3.8 Flash Cyber模型

原始标题:谷歌推出 Gemini 3.8 Flash Cyber 模型,内部已全面部署用于代码安全防护

来源
ithome
发布时间
2026-09-02T16:09:52
采集批次
2026-09-02-22
字数
1040
URL 指纹
0df0eda7386c2f61

📌 AI 总结(267 字)

谷歌于9月2日推出专为代码安全防护设计的Gemini 3.8 Flash Cyber模型,通过Fairwind计划向受信任的安全团队开放。该模型在CyberGym漏洞挖掘基准测试中表现顶尖,在20种编程语言的内部测试中漏洞挖掘成功率突破70%,CWE-Bench测试中Pass@1达47.2%。谷歌已在内部全面部署该模型,Chrome安全团队实测显示其修复补丁数量达顶尖商业模型的2.6倍,安全机构Wiz评测召回率提升7.5%-9.7%且成本降至1/5.2至1/2.3,Google云漏洞研究团队还借此在两小时内发现一处严重架构漏洞。
📄 正文(1040 字)
IT之家9月3日消息,当地时间9月2日,谷歌宣布推出Gemini 3.8 Flash Cyber模型,通过Fairwind计划面向首批受信任的安全防护团队开放。

官方表示,在针对漏洞挖掘的行业权威基准测试CyberGym上,Gemini 3.8 Flash Cyber展现出了顶尖水平的自主漏洞挖掘能力,不仅超越了前代3.5 Flash Cyber,还将多款体量显著更大的前沿模型甩在身后。

谷歌在更全面的内部基准测试中对Gemini 3.8 Flash Cyber进行了评测,该测试要求模型在涵盖20种编程语言的复杂代码工程中挖掘各类型的安全漏洞。结果表明,该模型相较于谷歌此前的模型实现了大幅跨越,漏洞挖掘成功率突破了70%。

谷歌表示,在研发Gemini 3.8 Flash Cyber时,其核心目标是为安全防御方赋予专业级能力,使其在面对攻击方时能够占据主导优势。正因如此,谷歌从一开始就重点投入漏洞修复领域,并将该项能力置于漏洞利用等攻击性手段之上。

在CWE-Bench测试中,Gemini 3.8 Flash Cyber稳居帕累托前沿,其首选正确率(Pass@1)达到47.2%,紧追顶尖前沿模型的47.8%,同时它的调用成本显著更低,在性能与成本之间实现了极佳的平衡。

谷歌表示,Gemini 3.8 Flash内置了完善的安全防护机制,在支持合规良性用例的同时,严密防范模型在化学、生物、放射性与核武器(CBRN)以及网络攻击领域的滥用风险。相比之下,Gemini 3.8 Flash Cyber适度放宽了网络安全领域的策略拦截限制,因此仅面向需要更完备网络攻防能力的合规安全团队开放。

目前谷歌内部已全面部署Gemini 3.8 Flash Cyber用于代码安全防护。具体落地案例包括:Chrome安全团队评估发现,针对Chrome浏览器中的安全漏洞,3.8 Flash Cyber生成有效修复补丁的数量达到了顶尖商业模型的2.6倍,而这些顶尖商业模型的参数规模要比它庞大得多。安全机构Wiz的评测表明,在其内部基准测试中,相较于其他顶尖的前沿模型,Gemini 3.8 Flash Cyber的召回率提高了7.5%-9.7%,同时调用成本大幅降低至原先的1/5.2到1/2.3。Google云漏洞研究团队借助3.8 Flash Cyber模型,耗时不到2小时便成功挖掘出一处严重的底层架构漏洞,而在此之前,这类漏洞的调研与排查通常需要数月之久。