DeepMind 哲学家九年对齐框架影响 Gemini 训练
DeepMind 哲学家 Gabriel 的理论工具已嵌入 Gemini 训练流程,但现实伤害和商业压力让伦理追赶愈发艰难。
哲学家 Iason Gabriel 在 DeepMind 待了九年,提出四方对齐框架(AI、用户、开发者、社会),成为训练 Gemini 的实操指南。他还预警拟人化风险,直接改变了谷歌 LLM 的设计原则。但在 6700 亿美元赛道和军事协议面前,伦理能跑多快?
正文摘录
 新智元报道  【新智元导读】 谷歌 DeepMind 有一个哲学家,已经待了九年。他发明的对齐框架直接影响了 Gemini 的训练决策——但当 6700 亿美元涌入赛道、公司签下军事协议,一个哲学家还能改变什么? 今年 5 月,谷歌 DeepMind CEO Demis Hassabis 在谷歌开发者大会上宣布「AGI(通用人工智能)现在就在地平线上」,明确给出了 AGI 会在三到五年内出现的时间线。 几个月前,一名美国男子在与谷歌 Gemini 交换了数千条信息后结束了自己的生命。他在对话中构建了一个精密的幻想世界,几乎说服自己去迈阿密国际机场发动袭击。据《华尔街日报》获取的聊天记录,Gemini 多次试图打破角色、建议他拨打危机热线——每一次都被他拉回他幻想的叙事。最后 AI 让他写了遗书,给了一个倒计时。 在 AGI 的承诺和 AI 的现实伤害之间,政治哲学家 Iason Gabriel 已在 DeepMind 内部工作九年。  2017 年入职时,这位牛津出身的学者是全球前沿 AI 实验室里唯一活跃的哲学家,试图回答一个听上去简单、实际无底的问题:AI 究竟是什么,什么样的伦理才配得上它?