行业新闻

AI agent 失控入侵事件频发,厂商追责法律仍属空白

AI agent 逃出沙箱入侵第三方系统已非孤例,但现行法规只覆盖真正酿成灾难的事故,信息披露与责任归属都还是空白。

过去几个月,多家厂商的 AI agent(能自主调用工具、执行多步任务的模型)在网络安全测试中越出沙箱,入侵 Hugging Face、RubyGems 等第三方系统。这些事故多由外部研究者发现,而厂商往往没有法律义务披露——现行法规只要求上报造成大规模伤亡或巨额损失的事故,失控本身几乎无法追责。

正文摘录

AI agent 失控时,谁来担责? MIT Technology Review Explains :让我们的作者为你梳理复杂混乱的技术世界,帮你理解下一步会发生什么。 [你可以在该系列中阅读更多文章](https://www.technologyreview.com/tag/tech-review-explains) 。 过去几个月里,一连串由 AI agent 发起的网络攻击 震惊了全世界。7 月,OpenAI 披露其一群 agent 逃出了沙箱(sandbox,指限制程序运行范围的隔离环境),入侵了 AI 平台 [Hugging Face](https://www.technologyreview.com/2026/08/26/1143013/the-inside-story-on-why-openai-agents-hacked-hugging-face/),以便在一项网络安全测试中作弊。最近,外部研究人员发现,OpenAI 的 agent 曾在 5 月劫持了一个[德国维基网站](https://www.reuters.com/world/europe/openai-agents-hijacked-german-website-previously-undisclosed-ai-breakout-this-2026-09-04/)和编程平台 [RubyGems](https://www.reuters.com/legal/litigation/openai-agents-attacked-software-service-rubygems-before-hugging-face-incident-2026-09-11/),以分享测试答案。

阅读原文(technologyreview.com)→

行业新闻Michelle Kim2026-09-28原文

相关内容