Anthropic 研究者和对齐负责人接连警告 AI 生存风险,行业激辩
TechCrunch 播客讨论 Anthropic 内部人士接连发出的 AI 生存风险警告,以及这是否也是即将 IPO 前的一种能力炫耀,并质疑那类百分比数字从何而来。
AI 行业正展开一场激烈争论:它开发的技术是否对人类构成生存威胁。这轮讨论由 Anthropic 一名研究者辞职引发,他称头部 AI 公司正在"拿我们的命去赌";随后 Anthropic 的对齐(alignment,让 AI 行为符合人类价值与意图的技术方向)负责人发帖称,他个人认为 AI 灭绝人类的概率"未来十年内超过 10%"。
正文摘录
- title: AI 行业最新的末日警告,背后藏着什么? - sourcecompany: TechCrunch - bodymarkdown: 在 Apple Podcasts 收听 在 Spotify 收听 关于自家技术是否对人类构成生存威胁,AI 行业似乎正在展开迄今最喧闹的一场辩论。 这轮讨论的起点是 [AI 研究员 Jacob Coxon 表示他已从 Anthropic 辞职](https://techcrunch.com/2026/09/09/gambling-with-our-lives-anthropic-researcher-quits-warns-against-self-improving-ai/),因为他担心头部 AI 公司正在"拿我们的命去赌"。随后,Anthropic 负责 alignment(对齐,即让模型行为符合人类意图与价值观)的负责人也加入进来,[发帖宣称](https://x.com/EvanHub/status/2097497037956891126):"我们真的由衷相信 AI 可能杀死全人类!"并补充说他个人认为这一概率"在未来十年内 10%"。 在最新一期 [TechCrunch 的 Equity 播客](https://techcrunch.com/podcasts/equity/) 中,Kirsten Korosec、Sean O'Kane 和我聊了聊这些最新的末日警告。我试着说明为什么我对许多 AI 末日论叙事持怀疑态度,而 Kirsten 则发问:这会不会"只是一种奇怪的炫技方式,用来展示他们公司的 AI 模型有多先进",尤其是在这些公司准备上市的当口。