模型智能小幅提升带来能力非线性增长
当然,4.6 并不比 4.5 聪明 4 倍,但它不必聪明 4 倍就能有用 4 倍。模型智能的小幅提升会在规划和反思等能力上产生非线性的结果。这就是为什么 Claude Code 和 OpenClaw 似乎在假期前后突然起飞,尽管它们在去年大部分时间都存在——原因是 GPT 5.2 和 Opus 4.5 刚好变得足够聪明,在这些框架中有用了一个数量级。而且这只会持续发生。感觉事情变化很快,但从现在开始只会更快加速。
@blader @_overment 别那么刻薄,你很清楚 Opus 4.6 并不比 4.5 强 4 倍。METR 的那个人承认这个结果说不通。