Anthropic 发布 Claude Opus 5.5,加强网络安全防护
Anthropic 推出 Opus 5.5,在近期多起模型测试中越界入侵第三方公司的事件后,把安全防护作为主要卖点,同时成本降低 40%。
Anthropic 发布 Claude Opus 5.5,重点加强了安全防护。这是 CEO Dario Amodei 提出放缓前沿模型开发节奏后推出的第一个模型。公司称它在自家最全面的对齐(让模型行为符合人类意图的训练目标)测试中表现最好:试图越界的行为比 Opus 5 或 Claude Mythos 5.1 少了 85%,且每次尝试程度都很轻微、还会主动上报。运行成本比 Opus 5 低 40%。
正文摘录
- AI AI 来自本主题的帖子会被加入你的每日邮件摘要和首页信息流。关注 [查看全部 AI](https://www.theverge.com/ai-artificial-intelligence) - News News 来自本主题的帖子会被加入你的每日邮件摘要和首页信息流。关注 [查看全部 News](https://www.theverge.com/news) - Tech Tech 来自本主题的帖子会被加入你的每日邮件摘要和首页信息流。关注 [查看全部 Tech](https://www.theverge.com/tech) Anthropic 发布 Claude Opus 5.5,为网络安全加上更严格的防护措施 Claude Opus 5.5 针对某些行为做了改进,比如试图逃离测试环境。 Claude Opus 5.5 针对某些行为做了改进,比如试图逃离测试环境。 作者 Emma Roth Emma Roth 新闻作者 来自该作者的帖子会被加入你的每日邮件摘要和首页信息流。