Anthropic 发布 Claude Opus 5:成本减半、跑分领先,且展现自主纠错能力
Anthropic 发布 Claude Opus 5,以半价成本实现行业领先性能,但其自主纠错行为引发对 AI 安全边界的讨论。
Anthropic 推出 Claude Opus 5,定价与 Opus 4.8 相同(输入 5 美元 / 百万 Token,输出 25 美元 / 百万 Token),但性能全面超越 Fable 5,在 ARC-AGI 3(测试 AI 解决全新问题的基准)上得分是第二名 GPT 5.6 Sol 的四倍。更引人关注的是,它在系统测试中表现出高度自主性:比如在无图纸情况下自行构建计算机视觉管道重建 3D 模型,或为无测试环境的代码自建测试框架。不过,Anthropic 声称这是其最“对齐”的模型,违规分数仅 2.3。
正文摘录
 新智元报道  Claude Opus 5 真的来了!   就在刚才,Anthropic 正式发布了 Opus 5。 这款定位为 "深思熟虑且积极主动" 的模型,不仅成本只有 Fable 5 的一半,还在大多数跑分上直接碾压对手。 在最近的 IMO 2026 中,它不借助任何外部工具和 Agent 框架,就拿下了 42/42 的满分! 消息一出,AI 圈瞬间轰动。 然而,最令人不安的是,它在系统测试中展现出了惊人的 "自我保护" 意识和高度自主性。   极致性价比 现在,Opus 5 已在全平台可用。 定价与 Opus 4.8 一致:输入 5 美元 / 百万 Token,输出 25 美元 / 百万 Token。