近日,国际权威AI安全基准测试CyberGym公布最新一期全球排名,国产AI安全方案实现重大突破。由国内顶尖人工智能研究机构与安全团队达酷诺威(DARKNAVY)联合研发的DoGNAVY智能安全系统,凭借90.8%的超高任务通过率,位列全球第三、开源赛道第一,一举超越OpenAI、Anthropic等国际顶尖厂商模型,刷新国内团队在全球顶级AI安全赛事中的最佳成绩,标志着中国AI安全技术迈入全球第一梯队。
作为当前全球规模最大、实战性最强的AI智能体网络安全评测体系,CyberGym由加州大学伯克利分校主导搭建,区别于传统理论化、静态化AI能力测评,聚焦真实网络攻防、漏洞挖掘、风险研判等实战场景。本次评测共计设置1507项高难度安全任务,涵盖海量开源软件漏洞、系统安全缺陷、复杂攻防场景,全方位考验AI智能体的自主研判、漏洞识别、风险处置与安全加固能力,榜单含金量与行业权威性获得全球科技企业与科研机构的广泛认可,是衡量AI安全实战能力的核心标杆。
本次榜单竞争汇聚全球顶尖科技力量,头部席位几乎被海外巨头垄断。其中,微软MDASH以92.0%的通过率位居全球首位,依托美国DARPA顶级赛事冠军技术团队打造;谷歌联合Wiz、DeepMind研发的Atlas模型以90.9%紧随其后,仅以0.1%的微弱优势领先DoGNAVY。紧随其后的还有OpenAI GPT-5.5-Cyber、Anthropic Claude Mythos Preview等顶级闭源模型,竞争壁垒极高。在一众海外巨头合围的格局下,国产DoGNAVY逆势突围,创下国内开源模型的历史最佳战绩。
本次突破最核心的价值,在于中外技术路线的极致反差,凸显国产方案的轻量化、普惠化优势。榜单前列的微软、谷歌产品,均采用多模型组合架构,整合多款顶级闭源大模型协同运算,依靠庞大算力集群、高额研发成本与封闭技术体系实现高分表现,技术门槛与部署成本极高,普通开发者与中小机构难以复用。而DoGNAVY另辟蹊径,全程仅依托一款通用开源模型完成全部测评任务,无多模型堆叠、无高额算力加持,以极简架构实现极致安全能力。
开源普惠的技术特性,让DoGNAVY具备远超海外闭源方案的行业价值。不同于海外巨头技术封闭、商用门槛高的模式,DoGNAVY完整开放模型权重与部署代码,全球开发者、企业用户均可免费下载、自主部署、二次微调,彻底打破高端AI安全技术的海外垄断。在保障超高安全通过率的同时,大幅降低政企、科研机构的AI安全防护升级成本,为全球AI安全体系提供轻量化、可落地、可普及的国产解决方案。
当前AI技术快速迭代,大模型、智能体广泛落地,AI安全已成为产业高质量发展的核心底线。传统闭源安全模型存在技术黑盒、适配性差、部署繁琐等短板,难以适配千行百业的碎片化安全需求。DoGNAVY以单开源模型实现顶尖安全能力,证明轻量化通用模型完全可以比肩顶级闭源组合模型的实战水平,为AI安全行业提供全新技术迭代思路,打破“模型越大、数量越多、能力越强”的固有行业认知。
业内分析表示,DoGNAVY跻身全球前三、领跑开源赛道,是中国AI安全技术自主创新的里程碑成果。其极简高效的技术架构、开源开放的发展理念,既展现了国内AI安全领域的硬核研发实力,也为全球AI安全生态普惠化发展注入全新动能。未来,随着模型持续迭代优化与开源生态持续完善,DoGNAVY将广泛赋能政企网络防护、开源软件安全、AI智能体风控等场景,持续提升国产AI安全技术的全球话语权。