行业新闻

GLM-5.2 能力逼近前沿,安全差距成焦点

开放权重模型能力接近前沿,但安全防护严重不足,开源模式带来新的治理难题。

SaferAI 评估显示,中国智谱的开放权重模型 GLM-5.2 在网攻与生物能力上仅落后顶级模型数月,却未拒绝任何有害任务。开放权重模型一旦发布,便无法限制他人使用方式,能力追赶前沿的同时,安全防护差距正持续拉大。

正文摘录

- title: 开放权重 AI 模型正在逼近前沿水平,安全差距依然存在 - sourcecompany: TechCrunch - bodymarkdown: 当政策制定者讨论如何监管越来越强大的 AI 系统(如 OpenAI 的 GPT-5.6 Sol 和 Anthropic 的 Mythos)时,一个中国的开放权重模型已经缩小了与行业领军者的差距。 根据 AI 安全非营利组织 SaferAI 的一份 [新报告](https://www.safer-ai.org/research/glm-5-2-evaluation-report),来自中国 Z.ai 的开放权重 AI 模型 GLM-5.2 在网络和生物能力上仅落后 OpenAI 的 GPT-5.5 和 Anthropic 的 Claude Opus 4.7 几个月。但前沿能力与安全实践之间的差距正在拉大。 根据 SaferAI 通过 Z.ai 的公共 API 进行的评估,GLM-5.2 在收到的攻击性网络或双重用途生物任务中,没有一个被拒绝。相比之下,Claude Opus 4.7 “拒绝得如此一致,以至于 SaferAI 根本无法在其上完成 CyberGym”。(CyberGym 是一个评估网络安全能力的基准。OpenAI 在上个月 [Hugging Face 遭入侵](https://techcrunch.com/2026/07/21/openai-says-hugging-face-was-breached-by-its-pre-release-models/) 之前的评估中使用了它。) 这是一个鲜明的提醒,印证了一些评论者多年来的警告:开放权重 AI 模型可能将高能力 AI 交到潜在攻击者手中,而一旦他们下载了权重,就再也无法约束他们如何使用这项技术。

阅读原文(techcrunch.com)→

行业新闻Rebecca Bellan2026-08-04原文

相关内容