动态

RL 训练不破坏可监控性,但存在监控税

OpenAI
在当今前沿的强化学习似乎不会破坏可监控性,反而有助于早期的推理步骤。但存在一个权衡:在相似能力下,运行更高推理努力的小模型更容易监控,代价是额外的推理计算(一种“可监控性税”)。
动态OpenAI2025-12-18原文

相关内容