微软 AI CEO 批评 Anthropic 的模型福祉理念,发布人本 AI 准则
微软 AI 负责人阐述自家 AI 治理原则,并点名批评 Anthropic 把模型当有感受的存在来对待,值得关注这场安全路线之争。
微软 AI CEO Mustafa Suleyman 在播客访谈中谈 AI 安全与监管:他认为 alignment(对齐,让模型内在倾向做正确的事)只是其中一环,单靠它不够,还需要面对「containment(可控封存)不可能、扩散不可避免」的现实。他还批评 Anthropic 关于模型意识的「model welfare」思路危险,微软同步发布了 37 页的《Humanist AI Code of Conduct》。
正文摘录
- title: 微软 AI CEO 称 AI 威胁真实存在,而 Anthropic 让情况更糟 - sourcecompany: The Verge - bodymarkdown:  今天,我和微软 AI CEO Mustafa Suleyman 聊了聊。你肯定已经注意到了,当下科技圈最大的新闻,就是围绕 AI 安全与监管愈演愈烈的争论。 Mustafa 对 AI 应该如何构建、如何监管有着强烈的观点,这一点也不让人意外。微软刚刚发布了一份 37 页的声明,名为 [“Humanist AI Code of Conduct”(人文主义 AI 行为准则)](https://microsoft.ai/code-of-conduct/),阐述了公司在 AI 开发上的原则,甚至包括它对 AI 意识这类棘手议题的哲学立场。 如果你还记得他上次上节目的内容,会发现 Mustafa 认为像 Anthropic 这样的公司,在所谓“模型福祉”(model welfare)这个概念上已经彻底跑偏,而且跑偏的方式相当危险。他本周还[发了一篇配套文章](https://mustafa-suleyman.ai/a-warning-about-model-welfare),专门批评 Anthropic 围绕 AI 意识的哲学,以及他认为这套哲学如何嵌入了更宏观的 alignment(对齐)辩论。 所以我特别想和 Mustafa 聊聊:在他看来,AI 安全领域里哪些担忧是真的、哪些不是;alignment 这个概念本身是否堪用;这个行业是否需要在把我们全弄死之前先慢下来。