RL 训练不破坏可监控性,但存在监控税 OpenAI在当今前沿的强化学习似乎不会破坏可监控性,反而有助于早期的推理步骤。但存在一个权衡:在相似能力下,运行更高推理努力的小模型更容易监控,代价是额外的推理计算(一种“可监控性税”)。 动态OpenAI2025-12-18原文 打开互动版