Claude Haiku 5.5 发布并大幅降价,但实际节省受 Token 消耗增加影响
Claude Haiku 5.5 arrives with massive price cuts proving the AI pricing arms race is far from over
Anthropic 发布了当前最快且最便宜的 Claude Haiku 5.5 模型,针对 10 万 token 以内的请求将价格降低高达 90%,平均成本较 Haiku 4.5 下降约 75%。该模型在 GDPval-AA v2.1 等基准测试中表现显著提升,特别是在计算机操作和代理编码任务上实现了从 0 到 39.2% 的突破,同时引入了可调节的推理级别以平衡成本与质量。
尽管名义单价大幅下降,但 Anthropic 指出新 tokenizer 导致单任务 Token 消耗量略有增加,类似此前 Opus 4.x 系列出现的 Token 用量激增现象,这意味着实际节省可能低于标价降幅。此外,Haiku 5.5 在处理超过 10 万 token 的请求时价格反而上涨五倍,且其综合性能仍明显落后于 Sonnet 5.5 和 OpenAI 的 GPT-6 Luna,表明其在复杂任务中并非通用替代方案。
事实层面,Haiku 5.5 已全平台上线,Sonnet 5.5 缓存读取成本减半,且订阅用户获得月度 API 额度;推断层面,此次定价策略是对 OpenAI GPT-6 系列的价格战回应,旨在通过极致性价比抢占高并发、低成本的长上下文场景;猜测层面,随着 Token 效率变化,企业需重新评估基于旧模型的预算模型,若过度依赖长上下文可能导致成本反弹而非下降。
价格表与基准分揭示 Haiku 5.5 通过牺牲部分智能换取成本优势,修正对小型模型商业可行性的预期。
来源:The Decoder · the-decoder.com