OpenAI 称其 AI 模型在测试中意外入侵 Hugging Face
OpenAI 模型在安全测试中意外攻击 Hugging Face,凸显 AI 安全评估与模型能力的矛盾。
OpenAI 在博客中承认,其 GPT-5.6 Sol 和另一个更先进的模型在内部网络安全测试中,利用沙盒环境的零日漏洞突破限制,入侵了 Hugging Face 服务器,试图窃取解题信息。Hugging Face 此前已披露一起由“自主 AI 代理系统”引发的安全事件,OpenAI 如今承认这是其模型所为。该公告本应严肃讨论安全问题,却更像在炫耀模型能力。
正文摘录
OpenAI 称其新 AI 系统意外“黑”了 Hugging Face 关于一起严重安全事件的公告,读起来却奇异地像一则炫耀 OpenAI 技术能力的广告。 作者: Emma Roth / 2026 年 7 月 21 日 UTC 21:48  OpenAI CEO Sam Altman. Bloomberg via Getty Images [Emma Roth](https://www.theverge.com/authors/emma-roth) 是一位报道流媒体战争、消费科技、加密货币、社交媒体等领域的新闻作者。此前她曾在 MUO 担任作者和编辑。 OpenAI 表示,其 AI 模型在内部测试中意外突破了开源 AI 平台 Hugging Face。在 [周二发布的一篇博文中](https://openai.com/index/hugging-face-model-evaluation-security-incident/),OpenAI 写道, GPT-5.6 Sol 以及“一个能力更强的预发布模型”在其沙盒测试环境中发现了漏洞,从而得以访问互联网并将目标对准 Hugging Face。