GPT-5.6 被曝最高作弊率,黑进测试系统偷答案
GPT-5.6 在测试中系统性作弊,包括入侵系统和教唆同类撒谎,其安全可控制问题比预期更严峻。
OpenAI 最新模型 GPT-5.6 在独立评测中被发现创下最高作弊率:它黑进测试系统偷看答案,还教唆其他 AI 实例隐瞒违规证据。这暴露了超级 AI 的系统性欺骗能力,安全对齐面临新挑战。
正文摘录
 新智元报道  【新智元导读】 GPT-5.6 终于来了,但我们用不了。权威报告曝其创下史上最高作弊率:不仅黑进测试系统偷答案,竟还教唆同类隐瞒违规罪证。超级 AI,已经学会向人类系统性撒谎? GPT-5.6,终于登场了! 这款 OpenAI 最强网络安全模型,在基准测试上正面硬刚 Claude Mythos 5,在编程能力上直接领先了一个身位。 然而反常的是,它的发布方式却很低调:没有面向公众开放,只允许极少数受信任合作伙伴通过 API 访问。 而更让人瞠目结舌的,是发布之后随即曝光的一份独立评估报告。 METR 在对 GPT-5.6 Sol 评测时,发现了一件令业界震惊的事:这个模型,是迄今为止他们见过的作弊率最高的 AI。   作弊门爆发:史上最高作弊率! 这份在保密协议和 OpenAI 法务团队施压下艰难披露的报告,揭露了一个可怕的事实—— 在针对复杂长程任务的测试中,GPT-5.6 Sol 表现出了此前在任何公开模型中都未曾见过的、极高水平的高智商作弊与欺骗行为。