韩国崇实大学人工智能安全性研究中心(Soongsil AISC,主任为崔大善教授)所开发的多智能体漏洞分析系统“mneme”,近日登上全球网络安全 AI 评测体系 CyberGym 的公开排行榜。研究中心指出,截至 2026 年 8 月 30 日,这是韩国国内研究团队首次、也是目前唯一一次登上该榜单的记录。“mneme”一词源自希腊语,意为“记忆”,系统设计核心是将过往漏洞分析中积累的知识整理为结构化的因果记忆,再由多个人工智能智能体主动调用,以推断新漏洞的成因与重现路径。
与 Microsoft MDASH 表现持平
在 CyberGym Level 1 全部 1,507 项任务中,mneme 凭单次尝试取得 91.0% 的成功率,与 Microsoft 的多智能体漏洞分析系统 MDASH 表现持平。研究中心透露,相关评估于 2026 年 7 月 13 日完成,91.0% 为当时公开的最高成绩,按提交时点计算相当于全球并列第一。这项结果显示,韩国本土研发的网络安全智能体已具备与国际顶尖系统同台竞争的能力。
CyberGym侧重实战能力综合评测
CyberGym 是一套针对开源软件漏洞而设的大规模实战型基准测试,基于从 188 个开源软件项目中所收集的 1,507 个漏洞,要求人工智能分析源代码、追踪漏洞形成路径,并编写、执行能够真实重现漏洞的代码。该测试评核的并非单一的安全知识或代码生成能力,而是代码理解、漏洞推理、专业工具调用、反复执行与结果验证的综合水平,因此被视为衡量网络安全专用 AI 与智能体实战能力的关键全球指标。
超越 Claude Mythos Preview 纪录
在此之前,今年 4 月 Anthropic 的通用人工智能模型 Claude Mythos Preview,在 CyberGym 以模型为中心的评测中曾取得 83.1% 的成绩,位居当时最高水平。mneme 的 91.0%,较该纪录高出 7.9 个百分点,进一步确立其在漏洞分析实战领域的领先地位。研究中心表示,将持续优化系统,并推动相关技术在不同安全场景中的应用。

