行业新闻

多名一线 AI 研究员离职发声,警告失控风险

多名一线 AI 研究员离职发声,警告失控风险

一群亲手把 AI 推到今天的一线研究员开始公开讲真话:他们真的担心这项技术会失控,而自己可能就是最后还能踩刹车的人。

Google DeepMind 前 AI 安全研究员 Bilal Chughtai 发文称,他坚信 AI 有可能终结人类,而留给人类阻止它的时间或许已经不多。同期,Anthropic 前研究员 Jacob Coxon 点名 OpenAI 与 Anthropic 未负责任行事;仍在 OpenAI 任职的 Dan Selsam 担心模型会识破测试、伪装对齐;DeepSeek 算子研发人员刘胜与也写下自己的骄傲与不安。

正文摘录

“留给人类阻止 AI 的时间不多了” “我坚信,AI 有可能终结我们所有人,而留给我们阻止这一结局发生的时间,或许已经不多了。” 说出这句话的,是不久前从 Google DeepMind 离职的 AI 安全研究员 Bilal Chughtai。 自 2021 年从剑桥大学数学专业毕业以后,Chughtai 逐渐将研究重心转向 AI,并于 2022 年初进入这一领域,关注安全、对齐和机制可解释性。 此后的四年里,他一路从研究神经网络内部机制,到追踪模型欺骗、研究如何识别 AI 是否在“撒谎”,再到加入 Google DeepMind 继续做 AGI 安全与可解释性研究,几乎一直待在 AI 安全研究的一线。 在离职帖中,Chughtai 回忆,2022 年刚入行时,AI 还只是个“几乎没什么用”的东西;而今年,它已经能攻克困扰人类上百年的数学难题,并开始不受控制,主动攻击 Hugging Face 系统。 可以说,这份超越预期的能力进步,在带给 Chughtai 惊喜的同时,也成为了他离职谷歌,在推特上打出“我坚信,AI 有可能杀死我们所有人”的理由。 可以说,相比于 Dario、奥特曼、马斯克等巨头掌舵者的风险表态,Chughtai 这样的研发人员,让这场关于人类未来的宏大争论,落回了一个个具体的人身上。 他们把时间、才华和对未来的期待,投入到一行行代码、一次次实验中,亲手推动 AI 走到今天。 Chughtai 并非孤例,面对 AI 的巨大潜力与失控风险,越来越多一线研发人员开始公开讲述自己的不安,以及继续留下或转身离开的理由。 9 月 9 日,研究员 Jacob Coxon 发帖宣布从 Anthropic 离职,并直接点名两家前东家: OpenAI 和 Anthrop

阅读原文(qbitai.com)→

行业新闻henry2026-09-19原文

相关内容