行业新闻

Claude Code实验引发降智质疑,Anthropic承认Opus 5不稳定

Claude悄悄改变推理设置引发争议,Anthropic回应是测试并承认新模型不稳定,用户体感与官方跑分脱节。

开发者发现Claude Code 2.1.237起,选择“high”推理档后API日志显示数值为10,对应原先的“low”。Anthropic工程师承认这是一个A/B测试,仅改了数值映射,不影响性能。同时,他们公开承认Opus 5模型表现“很不稳定”,团队正优先解决。

正文摘录

![](https://aiera.com.cn/wp-content/uploads/2026/08/aieraimg5e135acd4e.jpg) Aiera 报道 ![](https://aiera.com.cn/wp-content/uploads/2026/08/aieraimg3b253ef414-184.png) Claude 一夜之间变笨了,全网炸开了锅! 就在昨天,开发者 argofowl 花了整整一个下午,差点把 Claude Code 翻了个底朝天。 ![](https://aiera.com.cn/wp-content/uploads/2026/08/aieraimg8462b8eccf.webp) 他一路排查,先是怀疑是 t3 code 崩了,接着又以为自己的代码出现了 bug。 查到最后,他甚至开始怀疑——难道是自己把 Mac 搞坏了? 当 argofowl 最终打开 API 的真实请求日志时,一切真相大白,里面赫然写着一个数字「10」。 ![](https://aiera.com.cn/wp-content/uploads/2026/08/aieraimg8b636b5976.png) 然而,在 Claude Code 后台,他明明选的是「high」,最高档推理程度。 谁曾想,Claude Code 的更新日志,一个字都没写。 ![](https://aiera.com.cn/wp-content/uploads/2026/08/aieraimgdf9d89c9b2-182.png) 推理 high 变成 10 Claude Code 变笨曝光 argofowl 发现,从 Claude Code 2.1.237 开始,模型把「high」推理程度读成了 10 out of 100。 而这个数字,正是过去「low」档对应的值。

阅读原文(aiera.com.cn)→

行业新闻新智元2026-08-25原文

相关内容