Anthropic 于 2026 年 10 月 7 日正式发布 Claude Haiku 5.5,这是 Haiku 系列迄今速度最快、性价比最高的小型模型,主要面向大批量、对成本较为敏感的人工智能任务。

定位与定价:小模型里的”性价比之王”
Haiku 5.5 延续了该系列”小而快”的路线。Anthropic 将其定位为迄今最快、最高效的小型模型,适合摘要、分类、路由、内容压缩等高频但单次价值不高的工作。
在定价上,对 10 万 token 以内的请求,输入价格为每百万 token 0.10 美元,输出 0.50 美元;超过 10 万 token 的请求,输入升至 0.50 美元,输出 2.50 美元。借助提示缓存,用户最高可节省 90% 的费用;使用批量处理接口还能再打五折。Anthropic 表示,由于约九成历史请求集中在 10 万 token 以内区间,综合来看 Haiku 5.5 的整体调用成本较上一代 Haiku 4.5 平均下降约 75%。
规格跃升:百万上下文与可调算力
新模型支持 100 万 token 的上下文窗口,最大输出 12.8 万 token(通过批量 API 测试版可扩展至 30 万),知识截止时间为 2026 年 6 月。它也是首款引入”effort 控制”的 Haiku 模型——自适应思考(adaptive thinking)默认开启,effort 默认设为中等,开发团队可以针对每个任务在成本与智能程度之间灵活权衡。
能力方面,Haiku 5.5 接受文本与图像输入、输出文本,在编码、工具调用、计算机操作(computer use)与浏览器自动化上的表现较 Haiku 4.5 有明显提升。它既可作为独立模型直接服务,也能作为子智能体配合 Opus 5.5、Sonnet 5.5 等更大模型分工:由大模型规划,Haiku 5.5 负责表单填写、数据录入、跨应用搬运信息等重复性子任务。
基准成绩
根据 Anthropic 公布的评测数据,Haiku 5.5 在多项基准上大幅超越前代:OSWorld 2.1 离线子集准确率达到 72.4%,Terminal-Bench 4.0 编码测试得分 39.2%,GDPval-AA v2.1 知识测试取得 1620 分,FrontierCode 1.1 为 46.4%,人类终极测试(HLE)为 45.9%(启用工具后升至 57.4%)。
上线范围与配套调整
Haiku 5.5 目前已覆盖 Claude API(模型标识 claude-haiku-5-5)、Amazon Bedrock、Google Cloud、Microsoft Foundry 以及 Claude Platform on AWS;在 Claude.ai 的网页、iOS 与 Android 端,Free、Pro、Max、Team、Enterprise 用户均可选用,Claude Code 也已接入。
与此同时,Anthropic 同步下调了 Sonnet 5.5 的缓存读取价格:由每百万 token 0.20 美元降至 0.10 美元。由于缓存读取在多数智能体任务中占 token 消耗的大头,这项调整使 Sonnet 5.5 在多数智能体场景下的成本下降约 20%。面向 Max 与 Team 订阅用户,Anthropic 还新增了每月 API 额度:Max 5x 用户每月 100 美元、Max 20x 用户 200 美元、Team 用户最高 500 美元,可用于调用包括 Haiku 5.5 在内的各档模型。
安全护栏
在系统卡中,Anthropic 说明 Haiku 5.5 的网络安全防护比 Haiku 4.5 更严格,但略宽松于近期其他新模型:它允许更多防御性安全任务,仍会屏蔽渗透测试等更易被攻击者利用的用途。生物安全护栏则与 Sonnet 5、Sonnet 5.5、Opus 5 保持一致,允许研究性质的生物学提问,但限制可能造成危害的访问请求。
对于运行在大规模生产环境、对延迟和成本极度敏感的业务,Haiku 5.5 提供了一个在”够用”与”划算”之间取得平衡的新选项。







