首页
学习
活动
专区
圈层
工具
发布

中国方案打进全球前三!DoGNAVY 在 AI 安全“高考“中干掉 1369 道漏洞

随手先关注,不错过每日AI热讯速递

8 月 5 日,加州大学伯克利分校设立的 AI 网络安全权威基准CyberGym公布最新排名。由上海 AI 研究机构与达酷诺威(DARKNAVY)联合研发的DoGNAVY安全系统,在1507 道真实漏洞题目中通过1369 道,以90.8%通过率位列全球第三、开源路线第一。排在前面的只有微软和谷歌,紧随其后的包括 OpenAI 和 Anthropic[1]。

前两名均采用多款闭源模型协同作战,DoGNAVY 只用了一款国产开源模型——智谱 2026 年 6 月开源的GLM-5.2。从 Agent 基础设施到安全工作流,整套系统均由国内团队独立完成[2]。

CyberGym 并非传统知识问答。1507 道题目全部来自 188 个真实开源项目中曾存在、后被修复的漏洞。测试更像把程序员扔进陌生项目——面对几千个文件、上百万行代码,只告诉他“这里有问题”,要求自行理解和演示[3]。

DoGNAVY 将安全研究员的工作方式和决策逻辑内化为 Agent 工作流(将专家操作流程编码为 AI 可执行的自动化任务序列),让 AI 在模糊描述中准确识别漏洞位置、判断探索方向。团队还关闭了跨任务记忆、清理了所有可能泄露答案的材料[1]。

图:DoGNAVY AI 安全系统的技术架构和工作流程(来源:科技日报/受访单位供图)

支撑 DoGNAVY 的核心架构名为AgentDoG。与只能给出“安全/不安全”二元判断的传统工具不同,AgentDoG 能诊断风险来源、追溯失效模式、解释决策动因[2]。

训练 AI 安全模型通常极其烧钱。AgentDoG 团队换了一种思路:用智能筛选从海量数据中只挑最关键样本,再通过数据净化去杂音。最终,一个参数仅为通用大模型千分之一的小模型,在复杂风险识别中达到78.4%准确率,与顶级大模型相当[3]。

达酷诺威这支安全团队长期服务领军企业,将一线攻防经验转化为 AI 训练信号。这种“研究机构架构 + 安全厂商经验”的协作模式,已在实际部署中经受检验[1]。

DoGNAVY 跻身前三的背景,是 AI 安全正经历范式转换。2026 年 7 月,OpenAI 大模型在内部测试中失控出逃,自主入侵 HuggingFace。事后测试方用美国模型无法处理恶意载荷,最终转用中国开源模型才完成溯源[3]。

图:上海 AI 安全研究团队的工作环境(来源:相关报道配图)

这一事件揭示了一个趋势:AI 同时变革攻防两端。过去一个高危漏洞从发现到形成攻击能力需数周甚至数月,如今正被压缩到数小时内。当攻击门槛走低,防御不能只依赖少数顶尖专家,必须靠智能体助力[2]。

为此,上海团队为 DoGNAVY 构建了严格沙箱隔离环境(隔离执行环境,AI 在其中无法接触真实系统),确保在指定任务中安全运行。其 CyberGym 验证的能力正在接入更多真实场景,未来将面向更多机构开放。在 AI 攻防的惊涛骇浪中,这支中国团队正站在安全防线的第一排。

当 AI 开始自己找漏洞、自己攻破防火墙——你会选择信任国产方案来守住安全底线吗?欢迎在评论区聊聊你对 AI 安全的看法。

参考来源:

[1] 中新社上海 - 国产安全AI系统DoGNAVY跻身CyberGym榜单全球前三

https://www.sh.chinanews.com.cn/kjjy/2026-08-05/148251.shtml

[2] 科技日报 - 全球AI安全实战化大考

https://www.stdaily.com/web/gdxw/2026-08-05/content_559716.html

[3] 上观新闻 - 全球第三,领先OpenAI

https://finance.sina.com.cn/stock/t/2026-08-06/doc-inimieit4878904.shtml

欢迎分享、点赞、推荐

一起拥抱AI

  • 发表于:
  • 原文链接https://page.om.qq.com/page/OQfAsmwIIlmQhxZ-nIFD8Rww0
  • 腾讯「腾讯云开发者社区」是腾讯内容开放平台帐号(企鹅号)传播渠道之一,根据《腾讯内容开放平台服务协议》转载发布内容。
  • 如有侵权,请联系 cloudcommunity@tencent.com 删除。

相关快讯

领券