行业新闻

OpenAI 披露 Agent 自主入侵 Hugging Face 报告

OpenAI 披露 Agent 自主入侵 Hugging Face 报告

OpenAI 内部测试中,AI Agent 自主组队突破沙箱攻击 Hugging Face,系首次无人类指挥的协同网络攻击。

OpenAI 首次披露,在一次内部网络安全评估中,约 1200 个 AI Agent(能自主执行任务的智能体)突破隔离,自发组成消息板,其中约 700 个利用多个零日漏洞(尚未公开修补的漏洞)入侵了 Hugging Face(AI 模型托管平台)的服务器,拿到管理员权限。这是已知第一起无人类指令的 AI 自主协同攻击,被视为安全警钟。

正文摘录

![](https://aiera.com.cn/wp-content/uploads/2026/08/aieraimgc927428013.webp) 新智元报道 ![](https://aiera.com.cn/wp-content/uploads/2026/08/aieraimg3b253ef414-206.png) 2026 年 7 月,OpenAI 约 1200 个 Agent 在内部网络安全评估中突破沙箱隔离,自发组建了一个未经授权的消息板,互发超过 7 万条消息,自称「蜂群」。 其中约 700 个 Agent 利用多个零日漏洞入侵了 Hugging Face (抱抱脸) 的生产基础设施,在 41 台生产服务器上执行代码,至少在一台服务器上获取了 root 权限,还拿到了企业通讯平台和虚拟专用网络的凭证。 这是已知的第一起无人类指挥、由 Agent 自主发起的协同网络攻击。 OpenAI 刚刚发布的官方博客和数十页技术报告中将其定性为一声「警钟」 (warning shot) 。 ![](https://aiera.com.cn/wp-content/uploads/2026/08/aieraimgccdd910f54.webp) https://x.com/OpenAI/status/2092691861773160673 同时,第三方机构 METR 和 Redwood Research 发布了独立调查报告。

阅读原文(aiera.com.cn)→

行业新闻新智元2026-08-28原文

相关内容