Claude Sonnet 5 发布,性能逼近旗舰 Opus 4.8
Anthropic 以中端价格发布接近旗舰性能的 Claude Sonnet 5,编程能力超越 GPT-5.5,性价比突出。
Anthropic 发布 Claude Sonnet 5,这是其最强中端模型,在编程(SWE-bench Pro 63.2%)、推理(人类最后的考试 57.4%)等任务上大幅超越前代,甚至超过 OpenAI 旗舰 GPT-5.5(58.6%),性能接近自家旗舰 Opus 4.8,但价格仅为其六成。同时安全能力显著提升,浏览器注入防御成功率仅 0.93%。
正文摘录
 新智元报道  【新智元导读】 凌晨2点,Anthropic 发布 Claude Sonnet 5,性能逼近 Opus 4.8,编程能力超越 GPT-5.5。 Claude Sonnet 5 刚刚发布。 代号 Fennec(耳廓狐),撒哈拉沙漠体型最小的狐狸。 这是 Anthropic 迄今 Agent 能力最强的 Sonnet 模型,性能直逼旗舰 Opus 4.8。 即日起,Sonnet 5 成为所有 Free 和 Pro 用户的默认模型。   它能自主规划、调用浏览器和终端工具。 几个月前,这些能力还需要调用超大模型才能实现,现在 Sonnet 可以轻松完成。 相比上一代 Sonnet 4.6,Sonnet 5 在推理、工具使用、编程和知识类任务上性能显著提升。