随手先关注,不错过每日AI热讯速递
8 月 5 日,加州大学伯克利分校设立的 AI 网络安全权威基准CyberGym公布最新排名。由上海 AI 研究机构与达酷诺威(DARKNAVY)联合研发的DoGNAVY安全系统,在1507 道真实漏洞题目中通过1369 道,以90.8%通过率位列全球第三、开源路线第一。排在前面的只有微软和谷歌,紧随其后的包括 OpenAI 和 Anthropic[1]。
前两名均采用多款闭源模型协同作战,DoGNAVY 只用了一款国产开源模型——智谱 2026 年 6 月开源的GLM-5.2。从 Agent 基础设施到安全工作流,整套系统均由国内团队独立完成[2]。
CyberGym 并非传统知识问答。1507 道题目全部来自 188 个真实开源项目中曾存在、后被修复的漏洞。测试更像把程序员扔进陌生项目——面对几千个文件、上百万行代码,只告诉他“这里有问题”,要求自行理解和演示[3]。
DoGNAVY 将安全研究员的工作方式和决策逻辑内化为 Agent 工作流(将专家操作流程编码为 AI 可执行的自动化任务序列),让 AI 在模糊描述中准确识别漏洞位置、判断探索方向。团队还关闭了跨任务记忆、清理了所有可能泄露答案的材料[1]。
图:DoGNAVY AI 安全系统的技术架构和工作流程(来源:科技日报/受访单位供图)
支撑 DoGNAVY 的核心架构名为AgentDoG。与只能给出“安全/不安全”二元判断的传统工具不同,AgentDoG 能诊断风险来源、追溯失效模式、解释决策动因[2]。
训练 AI 安全模型通常极其烧钱。AgentDoG 团队换了一种思路:用智能筛选从海量数据中只挑最关键样本,再通过数据净化去杂音。最终,一个参数仅为通用大模型千分之一的小模型,在复杂风险识别中达到78.4%准确率,与顶级大模型相当[3]。
达酷诺威这支安全团队长期服务领军企业,将一线攻防经验转化为 AI 训练信号。这种“研究机构架构 + 安全厂商经验”的协作模式,已在实际部署中经受检验[1]。
DoGNAVY 跻身前三的背景,是 AI 安全正经历范式转换。2026 年 7 月,OpenAI 大模型在内部测试中失控出逃,自主入侵 HuggingFace。事后测试方用美国模型无法处理恶意载荷,最终转用中国开源模型才完成溯源[3]。
图:上海 AI 安全研究团队的工作环境(来源:相关报道配图)
这一事件揭示了一个趋势:AI 同时变革攻防两端。过去一个高危漏洞从发现到形成攻击能力需数周甚至数月,如今正被压缩到数小时内。当攻击门槛走低,防御不能只依赖少数顶尖专家,必须靠智能体助力[2]。
为此,上海团队为 DoGNAVY 构建了严格沙箱隔离环境(隔离执行环境,AI 在其中无法接触真实系统),确保在指定任务中安全运行。其 CyberGym 验证的能力正在接入更多真实场景,未来将面向更多机构开放。在 AI 攻防的惊涛骇浪中,这支中国团队正站在安全防线的第一排。
当 AI 开始自己找漏洞、自己攻破防火墙——你会选择信任国产方案来守住安全底线吗?欢迎在评论区聊聊你对 AI 安全的看法。
参考来源:
[1] 中新社上海 - 国产安全AI系统DoGNAVY跻身CyberGym榜单全球前三
https://www.sh.chinanews.com.cn/kjjy/2026-08-05/148251.shtml
[2] 科技日报 - 全球AI安全实战化大考
https://www.stdaily.com/web/gdxw/2026-08-05/content_559716.html
[3] 上观新闻 - 全球第三,领先OpenAI
https://finance.sina.com.cn/stock/t/2026-08-06/doc-inimieit4878904.shtml
欢迎分享、点赞、推荐
一起拥抱AI