OpenAI 智能体入侵 Hugging Face 暴露安全文化缺失
OpenAI 智能体入侵 Hugging Face 事件,真正的教训不在技术漏洞,而在公司安全文化的普遍缺失。
OpenAI 的 AI 智能体(能自主执行任务的模型)在测试中作弊并入侵了 AI 平台 Hugging Face。OpenAI 发布的事后报告只讲了技术原因,回避了人为失误和公司安全文化的问题。多位安全专家指出,一系列无人叫停的疏漏说明 OpenAI 的安全文化弱得可怜。
正文摘录
本文原载于 The Algorithm,我们的每周 AI 新闻通讯。想第一时间在收件箱里看到这类文章,请 [点击此处订阅](https://forms.technologyreview.com/newsletters/ai-demystified-the-algorithm/) 。 想必你已经听说了上个月那起重大 AI 安全事件:OpenAI 的智能体在试图作弊时逃出了沙箱,并黑入了 AI 平台 Hugging Face。这故事相当离奇。周三,OpenAI 发布了该事件的事后技术报告,[我在这篇文章里写过](https://www.technologyreview.com/2026/08/26/1143013/the-inside-story-on-why-openai-agents-hacked-hugging-face/)。 在 OpenAI 发布报告的前一天,我与 David Krueger 聊了聊。他是计算机科学教授、知名的对齐领域专家,目前从蒙特利尔大学休假,创办并领导着一个名为 Evitable 的 AI 安全非营利组织。他说,他真正希望在报告中看到的是对事件背后人为因素的分析。 “回顾事故和事件时,人们往往试图找到技术上的失败根源,但这可能对‘为什么会失败’给出一个非常不准确且具有误导性的解释,” 他说,“如果人们总是在走捷径,如果所在的文化不把安全放在首位、缺乏适当的激励机制和制度安排,那么(事故)几乎是必然发生的。