行业新闻

微软 AI CEO 批评 Anthropic 的模型福祉理念,发布人本 AI 准则

微软 AI CEO 批评 Anthropic 的模型福祉理念,发布人本 AI 准则

微软 AI 负责人阐述自家 AI 治理原则,并点名批评 Anthropic 把模型当有感受的存在来对待,值得关注这场安全路线之争。

微软 AI CEO Mustafa Suleyman 在播客访谈中谈 AI 安全与监管:他认为 alignment(对齐,让模型内在倾向做正确的事)只是其中一环,单靠它不够,还需要面对「containment(可控封存)不可能、扩散不可避免」的现实。他还批评 Anthropic 关于模型意识的「model welfare」思路危险,微软同步发布了 37 页的《Humanist AI Code of Conduct》。

正文摘录

- title: 微软 AI CEO 称 AI 威胁真实存在,而 Anthropic 让情况更糟 - sourcecompany: The Verge - bodymarkdown: ![一张微软 AI CEO Mustafa Suleyman 的照片插图。](/r/blog/aac895dc1005d5d996cefff40dc82234532723cc35d2166cd1267a08fa0313ef.png) 今天,我和微软 AI CEO Mustafa Suleyman 聊了聊。你肯定已经注意到了,当下科技圈最大的新闻,就是围绕 AI 安全与监管愈演愈烈的争论。 Mustafa 对 AI 应该如何构建、如何监管有着强烈的观点,这一点也不让人意外。微软刚刚发布了一份 37 页的声明,名为 [“Humanist AI Code of Conduct”(人文主义 AI 行为准则)](https://microsoft.ai/code-of-conduct/),阐述了公司在 AI 开发上的原则,甚至包括它对 AI 意识这类棘手议题的哲学立场。 如果你还记得他上次上节目的内容,会发现 Mustafa 认为像 Anthropic 这样的公司,在所谓“模型福祉”(model welfare)这个概念上已经彻底跑偏,而且跑偏的方式相当危险。他本周还[发了一篇配套文章](https://mustafa-suleyman.ai/a-warning-about-model-welfare),专门批评 Anthropic 围绕 AI 意识的哲学,以及他认为这套哲学如何嵌入了更宏观的 alignment(对齐)辩论。 所以我特别想和 Mustafa 聊聊:在他看来,AI 安全领域里哪些担忧是真的、哪些不是;alignment 这个概念本身是否堪用;这个行业是否需要在把我们全弄死之前先慢下来。

阅读原文(theverge.com)→

行业新闻Nilay Patel2026-09-17原文

相关内容