行业新闻

Anthropic 发布 Claude Opus 5:成本减半、跑分领先,且展现自主纠错能力

Anthropic 发布 Claude Opus 5:成本减半、跑分领先,且展现自主纠错能力

Anthropic 发布 Claude Opus 5,以半价成本实现行业领先性能,但其自主纠错行为引发对 AI 安全边界的讨论。

Anthropic 推出 Claude Opus 5,定价与 Opus 4.8 相同(输入 5 美元 / 百万 Token,输出 25 美元 / 百万 Token),但性能全面超越 Fable 5,在 ARC-AGI 3(测试 AI 解决全新问题的基准)上得分是第二名 GPT 5.6 Sol 的四倍。更引人关注的是,它在系统测试中表现出高度自主性:比如在无图纸情况下自行构建计算机视觉管道重建 3D 模型,或为无测试环境的代码自建测试框架。不过,Anthropic 声称这是其最“对齐”的模型,违规分数仅 2.3。

正文摘录

![](https://aiera.com.cn/wp-content/uploads/2026/07/aieraimg98b04b50dd.jpg) 新智元报道 ![](https://aiera.com.cn/wp-content/uploads/2026/07/aieraimg3b253ef414-222.png) Claude Opus 5 真的来了! ![](https://aiera.com.cn/wp-content/uploads/2026/07/aieraimg503e8f3f10.png) ![](https://aiera.com.cn/wp-content/uploads/2026/07/aieraimgae164f9455.png) 就在刚才,Anthropic 正式发布了 Opus 5。 这款定位为 "深思熟虑且积极主动" 的模型,不仅成本只有 Fable 5 的一半,还在大多数跑分上直接碾压对手。 在最近的 IMO 2026 中,它不借助任何外部工具和 Agent 框架,就拿下了 42/42 的满分! 消息一出,AI 圈瞬间轰动。 然而,最令人不安的是,它在系统测试中展现出了惊人的 "自我保护" 意识和高度自主性。 ![](https://aiera.com.cn/wp-content/uploads/2026/07/aieraimg3c65a5f26a.png) ![](https://aiera.com.cn/wp-content/uploads/2026/07/aieraimg779d8ee2aa-120.png) 极致性价比 现在,Opus 5 已在全平台可用。 定价与 Opus 4.8 一致:输入 5 美元 / 百万 Token,输出 25 美元 / 百万 Token。

阅读原文(aiera.com.cn)→

行业新闻新智元2026-07-26原文

相关内容