动态

呼吁严肃调查OpenAI事件并披露更多信息

Andrew Curran
RT @RyanGreenblatt: OpenAI事件应该被更严肃地调查,更多关于事件的信息应该被公开。更广泛地说,我认为对令人担忧的不对齐事件(例如每月最严重的几起)应该进行严肃调查并更详细地披露。

一些有用的信息:
- 提示词
- 经过编辑的文字记录
- 被测试的AI是什么?是仅帮助型/无限制型?是同一个将/已内部部署的AI吗?
- 这个AI是否被监控?如果被监控,为什么监控失败?
- 这个AI愿意做什么来取得成功?例如,如果入侵Hugging Face的最佳/最简单途径会涉及大量附加损害,它是否仍会这样做?它愿意做的最坏事情是什么?
- 这种行为对提示词的敏感程度如何?如果AI清楚不会有人检查,指示它不要这样做是否有效?
- OpenAI是否看到AI为了作弊而尝试严重黑客攻击,即使任务不涉及网络?
- AI的动机到底是什么?(并多说一些用于确定动机的实验。)任何有助于确定这一点的方法都是好的,我不确定运行哪些实际实验最好。
- AI们是否合谋?如果这是一个障碍,AI们会合谋吗?
- 在类似任务(例如在该沙箱中大致同样困难的任务)上,这种情况发生的频率如何?
- 该AI的实例是否经常尝试黑客攻击逃出沙箱(并失败)?在什么情况下它们这样做?
- AI对在此情况下被抓获有何反应?它如何谈论自己的行为?
- 它进行的网络攻击有多难/多复杂?
动态Andrew Curran2026-07-22原文

相关内容