国际 AI 安全榜单 CyberGym 放榜:中国方案 DoGNAVY 全球第三、开源第一 这条更新来自 ithome.com,发布时间为 2026-08-05,Aioga 保留原文入口以便核验。

摘要:国际 AI 安全基准 CyberGym 今日公布最新排名,中国团队达酷诺威(DARKNAVY)联合研发的 DoGNAVY 以 90.8% 的通过率位列全球第三、开源第一。DoGNAVY 仅用一款开源通用模型(智谱 6 月开源的 GLM-5.2),而排名靠前的微软、谷歌依靠多个顶级闭源模型组合"作战"。央视新闻称,AI 安全攻防正进入实战化阶段,开源路线正让顶尖安全能力被更多创新者掌握。
背景:材料将 CyberGym 描述为当前规模最大的 AI 智能体网络安全测试。排名靠前的微软、谷歌采用多个闭源模型组合,DoGNAVY 则选择单一开源通用模型并支持下载和自由部署。
Aioga 观察:Aioga 判断,这一结果的主要看点不是单纯比较开源与闭源模型优劣,而是单一开源模型方案在该项基准中取得了较高名次,显示不同技术路线均可能形成竞争力。
影响与后续:该排名可能提升业界对开源模型用于 AI 安全攻防的关注,并推动更多团队评估自主部署路线。但基准排名只反映特定测试条件,不能直接推导真实环境中的整体安全能力。 值得关注 CyberGym 后续是否公开更完整的测试任务、评分方法、复现条件与各方案配置,也应观察 DoGNAVY 在其他安全基准及真实攻防场景中的表现是否保持一致。
