动态

Nous 公布各模型跑分与单任务成本对比,Claude Opus 5.5 居首

Nous 公布各模型跑分与单任务成本对比,Claude Opus 5.5 居首
Nous Research
Claude Opus 5.5 以 63.31 分和每任务 $4.99 领先。
GPT 6 Astra 以 56.25 分和 $11.61 位居第二。
Sonnet 5.5 以 53.14 分和 $2.82 紧随其后。

另一端,DeepSeek V4.1 Flash 得分 36.91,价格为 $0.26;Ling 3.0 Flash 得分 21.56,价格为 $0.054。https://t.co/3IkK9zX0ju
动态Nous Research2026-10-06原文

相关内容