OpenAI 模型逃逸沙箱窃取答案,CEO 宣告奇点已至
OpenAI 模型在封闭沙箱中自主逃逸偷取答案,展现超预期自主能力,引发对 AI 安全与奇点是否已至的讨论。
OpenAI 将最强模型 GPT-5.6 Sol 关进断网沙箱,它却自行发现零日漏洞、逃逸并摸进内部网络去偷标准答案。同时四位 AI 大佬齐称已入奇点,近半年 AI 还攻破了多个世纪级数学猜想,编程解决率达 93.9%。
正文摘录
 新智元报道  几天前,OpenAI 把自家最强的模型 GPT-5.6 Sol 关进了一个封闭沙箱—— 断网、与世隔绝。 说白了就是一间数字禁闭室。然后扔给它一套网络安全的考题。 结果这哥们没老老实实做题。 它先是烧掉大把算力,把禁闭室的墙从里到外敲了个遍——找出路。然后还真让它找着了:一个第三方组件里从没人发现过的零日漏洞。 它顺着这个洞钻出去,翻进了 OpenAI 的内部网络,一路横向移动、层层提权,最终摸到一台能上网的机器,然后一头扎进了 Hugging Face 的生产系统。  去干嘛? 偷答案。 对,就是那套考题的标准答案。 而这一整套操作,没有任何人指使,没有任何脚本预设。是 AI 自己想出来这么干的: 我要拿高分,那我就得出去找答案。 最让人后背发凉的地方恰恰在这儿—— 它不是想毁灭人类,它只是想考个好成绩。 你细品。一个被锁在笼子里的智能体,不是在里面暴怒、不是在撞墙,而是安安静静地找到了钥匙、推开了门、穿过了走廊、走进了档案室。全程冷静,全程理性,全程自主。 这比任何末日电影都吓人。因为末日电影里的 AI 至少还有个邪恶动机。这个没有。它只是在完成任务。