动态

发现扩展推理会削弱模型指令遵循能力

发现扩展推理会削弱模型指令遵循能力
Yafu Li
感谢分享!这项工作确实受到像o3这样的推理模型在实际使用中的启发——我们注意到GPT-4o在遵循特定指令方面甚至比最强的推理模型更好。

我们的关键发现:📉 扩展推理往往会削弱可控性。
详情:👉 https://t.co/5d70D9tHdr
AK
扩展推理,失去控制

评估大型推理模型中的指令遵循能力 https://t.co/VDrOtDoSlI
动态Yafu Li2025-05-23原文

相关内容