动态

OpenAI 发布模型失准追踪、调查与披露框架及六份报告。

OpenAI
我们正在分享 OpenAI 用于追踪、调查和披露模型失准事例的新框架。

该框架设定了公开披露的标准和时间线,包括在我们尚未完全解释或缓解该行为时也会披露。更复杂的案例可能需要更长时间的调查或与第三方协调。

我们将优先考虑那些揭示新的失准机制、已知行为出现有意义变化,或挑战有关安全或缓解措施假设的案例。

除该框架外,我们还将发布六份报告,涉及我们在过去六个月训练或评估模型期间观察到的失准行为事例。

这是一个起点。我们将通过经验和公众反馈完善流程,并持续分享更多报告。

https://t.co/ismCCkeE0L
动态OpenAI2026-09-16原文

相关内容