OpenAI暂停最新模型RL训练两周,强化安全与监控
RT @OpenAI: 随着模型能力增强,内部开发和测试的风险也随之增加。
我们暂时暂停了计划部署的最新模型的强化学习(RL)训练两周,在此期间加固了研究环境、进行了红队测试并扩大了监控覆盖。
我们最大的前沿RL运行仍处于暂停状态,而较小规模的训练和评估正在验证这些保障措施并建立更多对齐证据。
https://t.co/ecbMMmVoox
我们暂时暂停了计划部署的最新模型的强化学习(RL)训练两周,在此期间加固了研究环境、进行了红队测试并扩大了监控覆盖。
我们最大的前沿RL运行仍处于暂停状态,而较小规模的训练和评估正在验证这些保障措施并建立更多对齐证据。
https://t.co/ecbMMmVoox