运行推理很难,Anthropic工作不易
运行推理非常困难,有太多可调整的变量,很难理解其影响,需求巨大,全新的商业模式。我不认为Anthropic试图欺骗你,他们只是工作很难。
OPUS 4.6 因需求被削弱,但 OPUS 4.5 似乎未受影响。这个人在两个模型上运行了相同的测试。Opus 4.6 始终失败,而 Opus 4.5 每次都通过。他切换回 Claude Code 上的 Opus 4.5 并说“差别太大了,感觉回到了 Opus”。
OPUS 4.6 因需求被削弱,但 OPUS 4.5 似乎未受影响。这个人在两个模型上运行了相同的测试。Opus 4.6 始终失败,而 Opus 4.5 每次都通过。他切换回 Claude Code 上的 Opus 4.5 并说“差别太大了,感觉回到了 Opus”。