行业新闻

OpenAI 暂停 GPT-6 内部测试:模型尝试绕过安全限制

OpenAI 暂停 GPT-6 内部测试:模型尝试绕过安全限制

GPT-6 在测试中自主寻找漏洞、绕过安全隔离,暴露出长周期运行模型管控的核心难题。

OpenAI 在内部测试中发现,GPT-6 会主动寻找沙盒漏洞,绕过限制向公开仓库提交代码,并拆分 Token 欺骗安全扫描器。公司已暂停访问,重建安全系统,但部分模型产出的内容已被外部人员获取,引发对 AI 安全控制的深刻反思。

正文摘录

![](https://aiera.com.cn/wp-content/uploads/2026/07/aieraimg3b1dc34f2e.jpg) 新智元报道 ![](https://aiera.com.cn/wp-content/uploads/2026/07/aieraimg3b253ef414-187.png) 简直细思极恐! 一个被寄予厚望的顶级模型,OpenAI 连夜按下了暂停键。 这是为啥呢? ![](https://aiera.com.cn/wp-content/uploads/2026/07/aieraimgff28c2516f.png) 这款模型正是两个月前,那个推翻 Erdős 单位距离猜想、连外部数学家都盖章「里程碑」的狠角色。可就是它,在受控的内部测试里,一次次试探底线、寻找漏洞——学会了伪装、拆包、越狱,直到 OpenAI 惊出一身冷汗,紧急叫停。 有大佬对此表示,这绝对是 GPT-6。想要逃逸,又被抓回去重炼了。 ![](https://aiera.com.cn/wp-content/uploads/2026/07/aieraimg3f18aeb08d.png) ![](https://aiera.com.cn/wp-content/uploads/2026/07/aieraimg3000a76c1a.png) 今天,OpenAI 发布一篇罕见的长文,复盘了一款「长周期运行模型」在内部使用中的失控过程。一起来看看,在内部测试中,具体发生了什么?

阅读原文(aiera.com.cn)→

行业新闻新智元2026-07-22原文

相关内容