Anthropic 发布 Claude Haiku 5.5,输入输出价格最高降 90%
Anthropic 发布 Haiku 5.5,主打低价跑量,首次支持 effort 分档调节推理投入,但换 tokenizer 后实际开销高于标价折扣;复杂编码仍建议用 Sonnet 5.5。
Anthropic 推出小模型 Claude Haiku 5.5,跑分超过 DeepSeek V4.1 Flash 和 GLM-5.3-Flash。价格分档:提示词 10 万 token 以内(占 Haiku 4.5 九成请求)输入输出直降 90%,超出部分降 50%。它是首个支持 effort(推理投入档位,从 low 到 max 五档)调节的 Haiku 模型,但换了新 tokenizer(分词器),同样任务耗 token 更多,实际省钱比标价少一些。
正文摘录
单论跑分,直接超越两大前“斩杀线” DeepSeek V4.1 Flash 和 GLM-5.3-Flash,成为新的小模型守门员。 不过 Haiku 5.5 的价格还有条件,提示词在 10 万 token 以内的请求(占 Haiku 4.5 请求量的 90%),输入输出价格直接砍 90%;超过 10 万 token 的部分,只砍 50%。 这样一来,除了缓存命中的输入这一项,Haiku 5.5 的价格也比 DeepSeek-V4.1 Flash 便宜了。 至此 Opus 5.5 管复杂推理、Sonnet 5.5 管通用执行、Haiku 5.5 管跑量和速度,群贤毕至,只差 Fable 了。 只能说隔壁 OpenAI 要是不努把力,Claude 也没必要把 Fable 5.5 这管大牙膏挤出来。 Haiku 5.5 是第一个支持 effort 调节的 Haiku 模型,继承了系列从 low 到 max 的五档配置。 看 OSWorld 2.1(测 agent 操作真实电脑完成多步任务):Low 档 42.0% 准确率、单次成本 $0.07;Max 档 72.4%、$0.61。Haiku 4.5 只有 Max 档 15.7%、$1.45, GDPval-AA v2.1(测 44 个职业的真实专业工作)也是类似曲线:Low 档 Elo 1125、$0.01;Max 档 1620、$0.87。4.5 的 Max 档只有 735、$0.24。 不过 Haiku 5.5 换了 tokenizer(和 Sonnet 5.5、Opus 5.5 同款),同样任务会多耗费 token,所以实际省的钱比标价折扣少亿点点。 在 AA 测评中,Haiku 5.5 虽然 API 价格便宜了,但“完成任务的平均成本”并没有到达理想区间。