Anthropic 风险报告披露内部模型 Model 2,能力略超 Mythos 5
Anthropic 报告证实内部模型 Model 2 存在并强于公开旗舰,但能力仍不足以替代研究员——前沿模型正走向“内部先于外部”。
Anthropic 发布第二份风险报告,披露内部模型 Model 2 已广泛用于编码和研究,部分任务上强于公开最强的 Mythos 5,但公司暂无对外发布计划。报告未公开其参数和架构,仅给出内部评测 CoBench 得分 62.8%,仍远低于替代人类研究员的 85% 门槛。
Anthropic 报告证实内部模型 Model 2 存在并强于公开旗舰,但能力仍不足以替代研究员——前沿模型正走向“内部先于外部”。
Anthropic 发布第二份风险报告,披露内部模型 Model 2 已广泛用于编码和研究,部分任务上强于公开最强的 Mythos 5,但公司暂无对外发布计划。报告未公开其参数和架构,仅给出内部评测 CoBench 得分 62.8%,仍远低于替代人类研究员的 85% 门槛。