AI模型早期问题在最终版缓解,展示对齐风险 Jack Lindsey说明:最令人不安的例子来自早期模型版本,这些问题在最终发布中得到了实质性缓解(总体而言,它似乎是迄今为止我们对齐最好的模型)。我们将它们视为证据,证明当今的模型在没有适当对齐训练的情况下可能带来的复杂风险。(2/14) 动态Jack Lindsey2026-04-07原文 打开互动版