Anthropic 发布 Opus 5,多项基准超越 Fable 5
Opus 5 性能更强、成本更低、限制更少,是多数场景下优于 Fable 5 的选择。
Anthropic 发布 Opus 5,新一代重型模型。虽比 Fable 5 更小,但更便宜、限制更少,且在多项基准测试中表现更优。它免除了 Fable 的 30 天数据保留政策,但在网络安全任务上仍有限制。
正文摘录
- title: Anthropic 发布 Opus 5 - sourcecompany: TechCrunch - bodymarkdown: 上周五,Anthropic 发布了其长期旗舰模型的最新版本 Opus 5。虽然比 Fable 5 更小,但该模型在价格和限制上均优于 Fable,很可能在大多数使用场景中更受欢迎。 值得注意的是,在公告中包含的多项基准测试中,Opus 5 实际表现优于 Fable 5。 Opus 5 的发布距离 Opus 4.8(5 月 28 日可用)仅两个月。Mythos 5、Fable 5 和 Sonnet 5 均在 6 月发布,目前只剩轻量级模型 Haiku 仍在等待升级至 5 系列。 [在发布新模型的博文中](https://www.anthropic.com/news/claude-opus-5),Anthropic 强调 Opus 5 “在验证自身工作并反复迭代直至成功方面更加强大”,并列举了基准测试结果——例如 Opus 5 根据一个不完整的提示自行编写了计算机视觉流水线(pipeline),以及其他案例。 关键的是,Opus 5 还摆脱了 Fable 自发布以来困扰它的许多限制。与其前代模型一样,Opus 5 不受 [30 天数据保留政策](https://support.claude.com/en/articles/15425996-data-retention-practices-for-covered-models) 的约束——该政策适用于 Fable 和 Mythos,曾引发部分注重隐私的用户的担忧。 Opus 上仍然有重要的安全防护措施,尤其是在网络安全任务方面,例如漏洞利用生成和渗透测试。比如,Opus 5 的安全防护措施禁止其被用于扫描软件二进制文件的漏洞,但允许其搜索源代码中的漏洞,因为后者更可能用于防御目的。