转推:GPT模型事实错误降65%,奉承降83%等进展。 Charlie Marsh转推 @aidan_mclau:自三月以来的一些亮点:1. 重大事实错误回复下降65%2. GPT-5.6 Sol在即时模式下比o3在高推理强度下更聪明3. 总体奉承行为下降83% 动态Charlie Marsh2026-09-09原文 打开互动版