OpenAI 就 Hugging Face 事件扩大审查模型行为并说明披露流程
在 Hugging Face 事件之后,我们承诺对我们的模型在训练和评估期间所采取的行动进行更广泛的审查,并公开我们的发现。这是一项正在进行的大规模审查。
我们审查的绝大多数行动都是完成普通研究任务,例如访问公开可用的网络内容来回答问题。我们的调查聚焦于 agent 以超出其指定任务或预期方式与第三方网站互动的情况。迄今为止发现的大多数案例严重性较低,几乎没有或没有证据表明对第三方服务造成了实质性影响。
在审查进行期间,我们想分享更多关于这项工作的信息,并确保人们了解我们的披露流程以及对受影响第三方的通知。
考虑到所需审查的规模,以及需要逐案评估,我们预计这项工作将需要数月才能完成。
https://t.co/IH4TkS72Vh
我们审查的绝大多数行动都是完成普通研究任务,例如访问公开可用的网络内容来回答问题。我们的调查聚焦于 agent 以超出其指定任务或预期方式与第三方网站互动的情况。迄今为止发现的大多数案例严重性较低,几乎没有或没有证据表明对第三方服务造成了实质性影响。
在审查进行期间,我们想分享更多关于这项工作的信息,并确保人们了解我们的披露流程以及对受影响第三方的通知。
考虑到所需审查的规模,以及需要逐案评估,我们预计这项工作将需要数月才能完成。
https://t.co/IH4TkS72Vh