行业新闻

OpenAI 被指灰度测试算力缩减版模型,Anthropic 陷降智门

OpenAI 被指灰度测试算力缩减版模型,Anthropic 陷降智门

OpenAI 和 Anthropic 的旗舰模型被曝性能缩水,用户怀疑是厂商为节省算力而暗中削弱模型。

OpenAI 被曝在 Codex 平台悄悄灰度测试新模型 gpt-5.6-sol,用户通过“Juice 测试”发现其推理算力配额降至正常版本的六分之一(128 vs 768)。同时,Anthropic 的 Claude Opus 4.8 被指大幅降智,推理能力大幅下滑,用户投诉其宛如“被切掉大脑”。这可能是两家巨头在算力成本与性能之间进行隐蔽实验。

正文摘录

![](https://aiera.com.cn/wp-content/uploads/2026/07/aieraimgf8fca12cce.jpg) 新智元报道 ![](https://aiera.com.cn/wp-content/uploads/2026/07/aieraimg3b253ef414.png) 【新智元导读】 最近,AI 社区经历了一波集体「降智」:OpenAI 疑似暗中灰度测试 GPT-5.6,一项神秘的「Juice」测试引发全民自查;同时,Anthropic 的 Claude Opus 4.8 被曝推理能力断崖式下降,疑似被限制推理深度。我们花钱订阅的 AI,究竟跑的是什么版本? 两大 AI 巨头——OpenAI 和 Anthropic,几乎在同一时间陷入了「降智门」? 过去 48 小时,AI 圈因一段神秘提示词掀起了一场全民自测狂欢。 OpenAI 被曝利用 Codex 平台悄悄灰度测试 GPT-5.6,暗中削减用户的思考预算(模型内部用于推理的算力配额)。 与此同时,Opus 4.8 遭遇史诗级削弱——曾经惊艳全场的模型,如今连最基础的逻辑推理都频繁翻车,甚至开始对用户进行 PUA(心理操控式回应)。 Opus 4.8 Max 被用户痛斥「被切掉了大脑」,性能从惊艳跌入谷底,甚至不如旧版 Haiku 模型。 莫非,我们正在经历巨头们精心设计的实验? ![](https://aiera.com.cn/wp-content/uploads/2026/07/aieraimgdf9d89c9b2.png) 神秘的 Juice 值——你被灰度到 GPT-5.6 了吗? 最近,AI 社区发现 OpenAI 可能正在小范围灰度测试 GPT-5.6-sol。

阅读原文(aiera.com.cn)→

行业新闻新智元2026-07-01原文

相关内容