谷歌推出Gemini 3.5 Flash Cyber轻量网络安全模型
该模型基于Gemini 3.5 Flash微调,用于快速发现、验证和修复软件漏洞,初期仅向政府和可信合作伙伴限量开放。
AI解读:谷歌此次发布的Gemini 3.5 Flash Cyber本质上是一款为网络安全任务专门调优的轻量模型,其经济性使得安全团队能以更低成本大规模扫描代码库。根据谷歌自己的测试,在Chrome生产环境提交扫描中,该模型显著优于主线的 3.5 Flash;在V8引擎的固定次数调用测试中,它发现了 55 个独特漏洞,高于 3.5 Flash的 47 个和Claude Opus 4.6的 36 个。安全事件中速度是关键,轻量模型带来的直接好处是:企业可以频繁地扫描代码,在漏洞被利用前发现并修复。目前该模型通过CodeMender工具向政府和可信伙伴限量开放,这意味着多数普通开发者暂时无法直接使用,需要等待后续的公开部署。如果你不是负责关键系统安全的专业团队,现阶段无需采取任何行动,但可以关注CodeMender在Gemini Enterprise Agent Platform上的一般可用版本,未来可能集成相关能力。
谷歌于 2026 年 7 月 21 日发布了Gemini 3.5 Flash Cyber,一个基于 3.5 Flash微调而来的轻量级网络安全模型,旨在快速查找、验证和修复软件漏洞。该模型将通过CodeMender以限量试点形式向政府和可信合作伙伴提供,并计划逐步扩大范围。
据谷歌介绍,3.5 Flash Cyber的性能和成本效率使其成为大型昂贵网络安全模型的替代方案。CodeMender可以多次调用该模型以分析更多代码路径,最终生成一份高质量报告。
基准测试结果
谷歌在多种基准上测试了 3.5 Flash Cyber。在CyberGym基准上,通过配置CodeMender最多调用 3.5 Flash Cyber五次来生成最终报告,整体代理在与显著更大的模型竞争时取得了具有竞争力的表现(具体数据来源为提供方自报)。
在谷歌Big Sleep团队独立构建的评估中,专注于Chrome和Safari等复杂代码库中的关键漏洞,3.5 Flash Cyber显著超过了主线的 3.5 Flash和 3.6 Flash。
在谷歌Chrome生产环境的提交扫描管线评估中,由于漏洞未公开披露,保证了基准无污染,结果显示 3.5 Flash Cyber相比 3.5 Flash有显著提升。
在V8 JavaScript引擎上,3.5 Flash Cyber在固定次数调用下发现了 55 个独特确认问题,高于主线 3.5 Flash的 47 个和Claude Opus 4.6的 36 个,其中包括另外两个模型未捕获的 10 个问题。
内部应用与早期反馈
CodeMender中的 3.5 Flash Cyber已在谷歌内部代码库中应用,包括Chrome、Android、Cloud、Ads和YouTube。例如,谷歌Cloud漏洞研究团队使用该模型在 2 小时内发现了公共API中的远程代码执行漏洞和一个敏感生产服务中的内存损坏漏洞,并生成一个绕过了ASLR和W^X等标准缓解措施的 100% 可靠远程代码执行漏洞利用。
Wiz和Cloud CISO安全工程测试人员的早期反馈确认了 3.5 Flash Cyber相比主线 3.5 Flash的重大能力提升。