跳到正文
原文
Latent Space·· 1 小时前精选AI 评分82

Claude Haiku 5.5 发布:匹配 GPT-6 Luna 定价但 Token 消耗更高

[AINews] Claude Haiku 5.5 — better than GPT-6 Luna at the same pricing

AI 导读

Anthropic 发布了 Claude Haiku 5.5,这是其 Haiku 系列一年来的首次更新,定价策略与 OpenAI 的 GPT-6 Luna 完全一致。该模型被定位为多模型智能体架构中的低成本执行层,专门用于处理高并发、低价值的任务如摘要生成和数据库查询。尽管官方宣称运行成本比上一代降低 75%,且 Intelligence Index 达到 43 分,超越 GPT-6 Luna 的 38 分,但独立评估显示其在同等分数下的 Token 消耗量约为 Luna 的 3 倍。

关键细节在于 Effort Settings(努力程度)设置带来的权衡。在 Max effort 模式下,Haiku 5.5 虽然智力表现更强,但输出约 162k tokens,而 Luna 仅需 50k tokens。此外,超过 100K token 的输入将触发 5 倍的价格阶梯,这对长上下文 Agent 循环构成潜在成本风险。尽管存在自动化测试因安全 Bug 导致的过拒绝问题,以及 Factual Recall 弱于 Gemini 3.8 Flash 的事实性缺陷,但在 Terminal-Bench 等特定工程任务上,Haiku 5.5 的表现显著优于竞品。

事实层面,Haiku 5.5 已上线并支持 1M 上下文窗口;推断层面,Anthropic 通过 Sonnet 缓存读取减半和订阅 API 赠款,试图构建针对 OpenAI 的生态壁垒;猜测层面,这种“低价高耗”的策略可能意在抢占长尾高频调用场景,而非单纯追求单点智力 SOTA。

推荐理由

材料揭示了 Haiku 5.5 在同等价格下以 3 倍 Token 消耗换取性能提升的机制,能校正对实际 Agent 工作流成本的判断。

来源:Latent Space · latent.space