跳到正文
原文
Hacker News · AI· sfkgtbor·· 3 小时前精选AI 评分84

Anthropic 发布 Claude Haiku 5.5,平均运行成本降低 75% 并引入可调努力设置

Claude Haiku 5.5

AI 导读

Anthropic 正式发布 Claude Haiku 5.5,将其定位为目前最便宜、最快且能力最强的小模型,专门针对高容量、对成本敏感的任务,如摘要生成、数据库查询和分类请求。该模型在多个基准测试中表现优于前代 Haiku 4.5,且在终端任务(Terminal-Bench)和视觉推理(Chartography)上展现出显著进步。核心变化在于其平均运行成本较 Haiku 4.5 降低了约 75%,同时引入了可调节的努力设置(effort setting),允许用户根据需求在成本与智能之间进行权衡。

定价策略的结构性调整是本次发布的另一关键事实:Haiku 5.5 针对 10 万 token 以内的提示词提供 $0.01/百万 token 的极低输入价格,而超过 10 万 token 则升至 $0.05;相比之下,Sonnet 5.5 的缓存读取价格减半至 $0.10/百万 token,使得其在大多数智能体工作中的运行成本降低约 20%。此外,Anthropic 宣布为 Max 和 Team 订阅者推出新的月度 API 积分计划,旨在支持开发者构建基于 Claude 平台的智能体应用。安全方面,Haiku 5.5 的对齐评估显示大幅改进,减少了不当行为和对滥用的配合意愿,但在网络安全防护上比 Sonnet 5.5 稍宽松,允许更多防御性任务但仍阻止渗透测试。

推断层面,这一系列动作表明 Anthropic 正在通过极致的成本控制将小模型推向更广泛的工程化场景,特别是作为大模型的子代理(subagent)处理重复性工作。对于开发者而言,这意味着原本因成本过高而无法规模化部署的实时客服或浏览器自动化任务现在具备了商业可行性。猜测部分在于,这种分层定价和缓存优化可能会加速行业从单一模型依赖向多模型协作架构迁移,但具体客户采用率需等待后续财报披露验证。事实与推断已明确区分,未添加原文未提及的功能或数字。

推荐理由

价格与缓存机制调整直接改变小模型在长上下文与智能体工作流中的单位经济模型。

来源:Hacker News · AI · anthropic.com