行业新闻

Anthropic 报告称 GLM-5.3 具备前沿级网络攻击能力

Anthropic 报告称 GLM-5.3 具备前沿级网络攻击能力

Anthropic 用一份带实测数据的报告,把开放权重模型的安全争议从「能力被蒸馏」推到「能力太强」,值得关注的是它给出的解决方案指向受控访问而非开源。

Anthropic 报告称智谱 GLM-5.3 是迄今网络攻击能力最强的开源权重模型,能自主发现并利用软件漏洞,综合水平距美国前沿约 4 个月;其拒答机制还能被 abliteration(通过修改开放权重来削弱模型拒答的技术)绕过,报告因此呼吁对强模型开展独立安全测试。

正文摘录

Anthropic,你是来给智谱打广告的吧! 事情的起因,是 Anthropic 一纸檄文状告了智谱的 GLM-5.3,大致意思是说: GLM-5.3 这个模型啊,它已经很会找软件漏洞、编写攻击程序,而且防滥用限制容易被绕过。大家得小心喽 例如在一项考察完整漏洞利用能力的 ExploitBench 测试中,同样尝试 410 次,GLM-5.3 成功了 50 次,Claude Mythos Preview 成功了 56 次。 文章顺带还引用了美国 NIST 下属 CAISI 在 9 月 17 日给出的评估,说“GLM-5.3 是迄今网络能力最强的开源权重模型,综合水平距美国前沿大约 4 个月”。 甚至 Anthropic 自己的研究人员还拿 GLM-5.3 去检查浏览器,找出了此前未知的漏洞,并在隔离环境里做出了能够读取测试电脑文件的攻击链。 在这份报告中,Anthropic 上来先铺垫了一件事,就是他们五个月前发的 Claude Mythos Preview,说是第一个能自主完成复杂、端到端漏洞利用的 AI 模型。 Anthropic 当时是觉得这个能力太敏感,于是没有选择公开发布,只是通过 Project Glasswing 开放给经过审核的防御者,让这些人抢先去修关键软件里的漏洞,据称已经找出了 1 万多个。 当时 Anthropic 就判断,这种能力迟早会扩散到别的模型身上。现在它的说法是:来了,就是 GLM-5.3。 而且在 Anthropic 看来,这事儿的门槛还有点低。

阅读原文(qbitai.com)→

行业新闻十三2026-09-30原文

相关内容