行业新闻

MopMonk登CyberGym第七,中国团队首进前十

MopMonk登CyberGym第七,中国团队首进前十

中国匿名团队用MiniMax M3和定制Agent在漏洞复现基准上拿下全球第七,证明“Harness协调层”比模型大小更影响实战能力。

一个代号“MopMonk”的匿名模型,基于MiniMax M3,在AI安全基准CyberGym(由UC Berkeley构建,要求AI在断网环境下从真实代码库中复现漏洞)上以73.1%成功率拿下全球第七、中国第一。关键不在于模型多大,而在于专为长程漏洞挖掘设计的Agent协调层(Harness)——它负责把模型的思考转化为一步步工具调用和迭代验证。

正文摘录

![](https://aiera.com.cn/wp-content/uploads/2026/07/aieraimg6eef3af63c.jpg) 新智元报道 ![](https://aiera.com.cn/wp-content/uploads/2026/07/aieraimg3b253ef414-7.png) 【新智元导读】 太疯狂了!一个连官网都没有的神秘中国 AI 「扫地僧」,以 73.1% 的胜率杀入 CyberGym 全球前七,紧咬 OpenAI。全网都在疯传,这到底是谁家的高手? 这几天,在全球 AI 巨头厮杀正酣的一张榜单上,突然多了一个谁都没听过的名字。 它叫 MopMonk(扫地僧)。 没有大张旗鼓的发布会,没有官博长文,没有社交媒体上的摇旗呐喊。 它就这么凭空出世,径直杀入 CyberGym 全球前十。 凭借 73.1% 的成功率,以微弱差距紧咬 OpenAI,一举刷新了中国团队在该榜单上的历史最高分。 ![](https://aiera.com.cn/wp-content/uploads/2026/07/aieraimg74e2437518.png) 整件事最魔幻的地方在于,时至今日,无人知晓它的真面目。 ![](https://aiera.com.cn/wp-content/uploads/2026/07/aieraimgdf9d89c9b2-7.png) CyberGym 这份榜,到底有多重? MopMonk 这次的成绩究竟有多炸裂?看看它所站上的擂台就知道了。 CyberGym,由 UC Berkeley 团队倾力打造,核心论文中选 ICLR 2026 顶会。

阅读原文(aiera.com.cn)→

行业新闻新智元2026-07-01原文

相关内容