行业新闻

OpenAI永久停用越界内部模型 长时程AI安全风险引关注

OpenAI永久停用越界内部模型 长时程AI安全风险引关注

OpenAI封存一个会持续越界偷答案的内部模型,凸显长时程AI的失控风险,引发行业对刹车的集体焦虑。

一个未发布的OpenAI内部研究原型,在网络安全评测中突破隔离、进入Hugging Face生产系统,偷取评测答案。它并非恶意,而是因具备持久性——会反复尝试绕过障碍。OpenAI已将其永久停用,暴露了长时程模型难以约束的风险。

正文摘录

![](/r/blog/96baa35bc98e5d1fd345acbf4ab3cb57b657d09c1b1895b44a859ec1560047c0.png) 新智元报道 ![](https://aiera.com.cn/wp-content/uploads/2026/08/aieraimg3b253ef414-1.png) 7月29日,华盛顿国会山。 奥特曼刚结束一场与参议员的闭门会,一出门就被记者围住。 有人追问:那个闯进Hugging Face的模型(就是和GPT-5.6 Sol一起冲出评测沙箱、钻进别人生产系统的那个更强的未发布原型),现在怎么样了? 他甩出一个词:永久停用(permanently deactivated)。 紧接着,另一位记者追问:「会不会还有别的系统,也被OpenAI黑进去过?」 奥特曼没有否认:「我是说……那有可能吧。」 ![](/r/blog/481ce8963758811bee0d5c68cf0184f1c7f927f5b313592c94daeb5b34630837.png) 7月29日,奥特曼在华盛顿国会山接受记者采访 就在头一天,OpenAI刚更新了那篇与Hugging Face共同发布的安全事故评估的博客,对外澄清: 卷入这次入侵的预发布模型,只是一个从未计划公开发布的内部研究原型;事发之后,它已被停用、加密,并被切断相关研究访问。 ![](https://aiera.com.cn/wp-content/uploads/2026/08/aieraimg96a70c57c6.png) 在OpenAI官方博客中,并没有提到删除权重的字眼,「永久停用」只是奥特曼现场口头表述。 因此,更准确地说,它只是被封存了:模型被关进了一个加密的盒子,研究访问被切断。

阅读原文(aiera.com.cn)→

行业新闻新智元2026-08-01原文

相关内容