Anthropic 发布 Claude Haiku 5.5:成本直降 75%,5.5 系列正式集结
Anthropic 于 10 月 8 日正式发布 Claude Haiku 5.5。至此,Claude 5.5 系列三款模型全部到位:Opus 5.5 负责复杂推理与长期任务,Sonnet 5.5 面向日常办公与高频开发,Haiku 5.5 则补齐高吞吐、低成本场景,形成从高端推理到大规模调用的完整产品矩阵。

Anthropic 于 10 月 8 日正式发布 Claude Haiku 5.5。至此,Claude 5.5 系列三款模型全部到位:Opus 5.5 负责复杂推理与长期任务,Sonnet 5.5 面向日常办公与高频开发,Haiku 5.5 则补齐高吞吐、低成本场景,形成从高端推理到大规模调用的完整产品矩阵。
Haiku 5.5 被 Anthropic 定位为目前最快、最便宜、能力最强的 Haiku 系列模型,平均运行成本较 Haiku 4.5 下降约 75%。其中,提示词不超过 10 万 Token 的请求降价幅度最大,输入价格为每百万 Token 0.10 美元、输出价格为 0.50 美元,较上一代下降 90%;超过 10 万 Token 的请求,输入和输出价格分别为 0.50 美元和 2.50 美元,较上一代下降 50%。
性能方面,Haiku 5.5 在多项任务上较前代显著提升。电脑操作测试 OSWorld 2.1 离线子集成绩从 15.7% 提升至 72.4%,智能体编程测试 Terminal-Bench 4.0 从 0% 提升至 39.2%,知识工作测试 GDPval-AA v2.1 达到 1620 分,AA-Briefcase v1.1 达到 1578 分。 在 Anthropic 公布的对比中,Haiku 5.5 在知识工作、电脑操作、智能体编程和视觉推理等多项指标上优于 OpenAI 近期发布的 GPT-6 Luna。
Haiku 5.5 也是首款支持可调节“effort”推理强度设置的 Haiku 模型,提供 Low、Med、High、Xhigh、Max 五档,用户可根据任务在成本与智能程度之间灵活选择。 官方将其核心用途锁定在摘要、上下文压缩、数据库查询、分类等批量重复任务,以及作为 Opus 5.5 和 Sonnet 5.5 执行编码任务时的“子智能体”。
与此同时,Anthropic 同步下调 Sonnet 5.5 的缓存读取价格,从每百万 Token 0.20 美元降至 0.10 美元。由于缓存读取在智能体任务中占比较高,这一调整可使 Sonnet 5.5 在多数 Agent 任务中的运行成本降低约 20%。 此外,Claude Max 和 Team 订阅用户本周起将获得每月 API 额度,Max 5x 为 100 美元,Max 20x 为 200 美元,Team 最高 500 美元,可用于任意可用模型。
随着旗舰模型持续升级、轻量模型价格下探,大模型竞争正在从单纯追求参数和跑分,转向更关注“单位任务成本”和实际部署效率。Haiku 5.5 的发布意味着,高频、低成本、可规模化调用的能力,正成为下一阶段模型竞争的关键变量。
目前,Claude Haiku 5.5 已在 Claude 平台、AWS、Google Cloud 和 Microsoft Azure 上线,模型 ID 为 claude-haiku-5-5。