中新网上海新闻8月5日电(记者 陈静)记者5日在此间获悉,由上海头部AI研究机构等打造的 AI 安全系统 DoGNAVY,在全球公开的AI网络安全能力评测基准CyberGym 中位列公开榜单第三、开源模型路线第一,率先成为榜单上进入全球前三的国产方案。
CyberGym被业界视为AI安全能力的公开竞技场。它准备了1507 项任务,全部来自188个真实开源项目中曾经存在、后来被修复的漏洞。该测试要求AI在只有代码和一段简短描述的条件下,自主理解问题、定位漏洞并完成验证,不能参考任何已知的修复方案。最终,DoGNAVY 通过其中1369 项。
据悉,前两名均采用多款顶尖闭源模型协同作战的策略,DoGNAVY 只使用了一款国产开源模型——GLM-5.2,可通过公开渠道下载并部署。从Agent基础设施到安全工作流,整套系统均为国内团队协作完成。这背后是一支将安全研究员经验系统化的AI团队。
当日,记者了解到,CyberGym考验的是长时间探索、验证、纠偏的能力,而这恰恰是高水平安全研究员在无数次真实攻防中积累下来的核心经验。DoGNAVY 将安全研究员的工作方式和决策逻辑内化为Agent工作流,让AI学会在模糊描述中准确识别漏洞位置、判断探索方向。中国团队还构建了严格的沙箱隔离环境,避免AI在评测中逃逸或访问外部信息。据透露,在此次评测中,团队关闭了跨任务记忆,每项任务均从独立环境开始,并在系统启动前清理历史PoC、补丁及其他可能泄露答案的材料。
DoGNAVY国产的不只是一款模型,从Agent基础设施到安全研究工作流也均由国内团队完成。在采访中,记者了解到,支撑DoGNAVY的相关技术体系也在真实业务和部署场景案例中接受检验。
此次在CyberGym中得到验证的能力,后续也将逐步与平台衔接,进入更多真实场景。DoGNAVY 还将与相关计划协同,面向更多创新组织开放能力,汇聚模型、AI研究、安全与产业各方力量,让顶尖安全攻防能力不再只属于少数区域和机构,而能被更多创新者获得、使用并共同建设。(完)
注:请在转载文章内容时务必注明出处!
编辑:李秋莹






