动态

Anthropic切断第三方订阅,MiMo推Token Plan,谈计算分配与智能体发展

Fuli Luo
两天前,Anthropic切断了第三方工具使用Claude订阅的通道——这并不意外。三天前,MiMo推出了它的Token Plan——一个我花了不少时间设计、并且我认为是认真尝试解决计算分配和智能体工具开发的方案。把这两件事放在一起,我有几点想法:

1. Claude Code的订阅是一个设计精妙的平衡计算分配系统。我猜测它不赚钱,甚至可能亏钱,除非它们的API利润率有10-20倍,但我怀疑这一点。我无法精确计算第三方工具接入带来的损失,但我仔细看过OpenClaw的上下文管理——很糟糕。单个用户查询中,它会以独立的API请求发起多轮低价值工具调用,每个请求携带很长的上下文窗口(通常超过10万token)——即使有缓存命中也很浪费,极端情况下还会推高其他查询的缓存未命中率。每个查询的实际请求次数比Claude Code自身框架高出数倍。换算成API定价,实际成本可能是订阅价格的几十倍。这不只是差距——这是天壤之别。

2. 像OpenClaw/OpenCode这样的第三方工具仍然可以通过API调用Claude——只是不能再搭订阅的便车了。短期内,这些智能体用户会感到痛苦,成本轻松上涨几十倍。但正是这种压力推动这些工具改进上下文管理,最大化提示缓存命中率以重用已处理的上下文,减少浪费的token消耗。痛苦最终会转化为工程纪律。

3. 我敦促LLM公司不要在没有弄清如何给编程套餐定价而不亏本之前,盲目打价格战。以极低的价格出售token,同时为第三方工具敞开大门,对用户来说看起来不错,但这是一个陷阱——正是Anthropic刚刚走出的陷阱。更深层的问题是:如果用户把注意力浪费在低质量的智能体工具、高度不稳定且缓慢的推理服务以及为了降成本而降级的模型上,最终发现还是什么都做不成——这对用户体验和留存来说不是一个健康的循环。

4. 关于MiMo Token Plan——它支持第三方工具,按token配额计费,逻辑与Anthropic新推出的额外使用包相同。因为我们追求的是长期稳定地提供高质量的模型和服务——而不是让你冲动付费然后弃船。

更大的图景:全球计算能力跟不上智能体创造的token需求。真正的出路不是更便宜的token——而是共同进化。“更高效的token智能体工具”乘以“更强大更高效的模型”。Anthropic的这一举动,无论是否有意,都在推动整个生态系统——包括开源和闭源——朝这个方向前进。这可能是件好事。智能体时代不属于谁燃烧的计算最多。它属于谁使用得最明智。
动态Fuli Luo2026-04-05原文

相关内容