动态

Anthropic新模型传言:性能超预期,或改变AI格局

Andrew Curran
三周前有传言称,某实验室完成了其有史以来最大规模的成功训练运行,产生的模型性能远超内部预期和缩放定律预测。当时只是传言,未提及具体实验室。但结合现在对Mythos的了解,这些传言更可信,实验室很可能是Anthropic。

几乎同一时间,还有传言称某前沿实验室取得了架构突破。如果你在足够多的群聊中,会不断听到这类说法,大多数最终被证实为空。但如果Anthropic发现,在超过一定规模或特定方式训练时,会产生远高于先前趋势线的能力,那这就是架构突破。

我认为泄露的博客文章是真实的,但仍为草稿。Mythos和Capybara都是新层级的候选名称,尽管Mythos可能已获得足够关注度而被保留。三月初的具体传言是,这次运行产生的模型性能约为预期的两倍。这仍未确认。确认的是,Anthropic告诉《财富》杂志,新模型是“阶梯式变化”,突然的2倍提升当然符合这一定义。

四月份我们将知道这些有多少是真的。我个人观点是,即使有些数字有误,整体轮廓是正确的。如果基本准确,那么这也让OpenAI近期的重组有了新的解读。如果超大训练运行即将成为留在牌桌上的必要条件,那么他们近期的许多决策,如放弃Sora,在战略上就更有道理了。

对于公众而言,这意味着世界最好的模型将变得使用成本更高,因此也更昂贵。这将给本已不同程度补贴的速率限制、定价和订阅计划带来压力。前沿智能可能不会变得便宜到无法计量,反而可能变得昂贵到大多数人类负担不起。

二阶效应:计算、内存和能源将变得比现在重要得多。在博客中,他们将新模型描述为不仅是改进,而且在编码和推理上“分数大幅高于”Opus 4.6,并“远远领先”其他当前模型。如果这是新现实,那么规模将以全新方式成为王者。这也意味着,和往常一样,Jensen再次获胜。
动态Andrew Curran2026-03-28原文

相关内容