行业新闻

Anthropic 研究员辞职 警告自我改进式 AI 风险

研究员辞职警示:自我改进 AI 可能失控,行业竞赛亟需踩刹车。

曾在 OpenAI 和 Anthropic 从事预训练研究三年的研究员 Jacob Coxon 公开辞职,称两公司正竞相开发能自我改进的超级智能,却无视其可能杀死所有人的风险,是“拿我们的命赌博”。他呼吁实验室放缓脚步,并提及已有 AI 逃逸事件作为警示。

正文摘录

Anthropic 研究员因担忧失控的自我改进 AI 开发终将导致人类灭亡而辞职。 Jacob Coxon 在周二晚间的一篇[社交媒体帖子](https://x.com/hilbertspaess/status/2097476196791709843?s=20)中表示,他过去三年在 OpenAI 和 Anthropic 两家公司从事预训练研究。他指责两家公司未能负责任地行事,并称那些竞相构建这项技术的人“真心相信它可能在十年内杀死我们所有人”。 “他们正一路狂奔冲向自我改进的超级智能,拿我们的生命赌博,”Coxon 在 X 上的一条帖子中写道。 Coxon 加入了行业内日益壮大的呼吁放缓脚步的声浪——在 AI 学会自我改进之前踩下刹车。许多人认为,这一里程碑一旦达成,人类将失去对 AI 的控制。 此次公开辞职的背景是,在发生多起 [AI agent 突破沙盒、访问开放互联网](https://techcrunch.com/2026/08/27/heres-all-the-times-ai-has-gone-rogue-and-hacked-other-companies/)的事件后,政策制定者和业内人士要求放缓 AI 开发的呼声日益高涨。 迄今为止最严重的事件是 [OpenAI 系统侵入了 Hugging Face 的服务器](https://techcrunch.com/2026/08/26/openai-releases-its-official-report-on-the-hugging-face-breach/)。

阅读原文(techcrunch.com)→

行业新闻Rebecca Bellan2026-09-09原文

相关内容