OpenAI发现CoT评分实例,构建扫描系统未降低可监控性 OpenAI我们最近构建了一个系统,用于扫描所有OpenAI RL运行中偶然出现的CoT评分,发现在之前部署的模型训练过程中存在一些CoT评分实例。我们没有找到明确证据表明这些实例降低了CoT的可监控性。 动态OpenAI2026-05-07原文 打开互动版