对齐使语言模型规范性而非描述性,base模型在战略游戏中表现更好 DailyPapers对齐使语言模型变得规范而非描述性我们比较了120个基础-对齐模型对在10000+人类决策上的表现。在战略游戏中,基础模型的性能优于对齐模型近10:1。对齐学习人类应该做什么;基础模型学习人类实际做什么。 动态DailyPapers2026-03-19原文 打开互动版