核心要点
- 价格降到原来的约一成:10 万 tokens 以内的请求,输入 $0.10 / 输出 $0.50 每百万 tokens,缓存读取 $0.01。官方测算,即便算上新分词器多出的 token,这类请求的成本也比 Haiku 4.5 低约 90%
- 能力跨代提升:官方公布 GDPval-AA 知识工作 1620(Haiku 4.5 为 735)、OSWorld 2.1 电脑操作 72.4%(Haiku 4.5 为 15.7%)、Terminal-Bench 4.0 39.2%(Haiku 4.5 为 0%)
- 1M 上下文、128K 输出:Haiku 4.5 只有 200K 上下文和 64K 输出;同时成为第一款支持 effort 档位(
low到max)的 Haiku - 超过 10 万 tokens 单价翻 5 倍:输入 $0.50 / 输出 $2.50。长文档、长对话类负载要先算账
- API易 已上线:
claude-haiku-5-5与claude-haiku-5-5-thinking,OpenAI 兼容与 Anthropic 原生双端点,两档分段计费与官网逐项一致
背景介绍
2026 年 10 月 7 日,Anthropic 发布 Claude Haiku 5.5,Claude 5.5 系列至此补齐:Opus 5.5 9 月下旬发布,Sonnet 5.5 9 月 28 日发布,Haiku 5.5 是最后一款,官方称它是 Anthropic「最便宜、最快、能力最强的小模型」。 Haiku 一直是 Claude 家族里跑量的那一档:分类、抽取、路由、摘要、给大模型当子代理。上一代 Haiku 4.5 发布于 2025 年 10 月,距今正好一年。这一代的变化不是小修小补:上下文从 200K 扩到 1M,思考模式改成与 Sonnet / Opus 相同的自适应思考 + effort 档位,而 10 万 tokens 以内的单价直接降到 Haiku 4.5 的十分之一。 官方也说得很清楚它不擅长什么:复杂的 Agent 编程仍然该交给 Sonnet 5.5 和 Opus 5.5,Haiku 5.5 适合范围明确的窄任务,以及在这两款大模型下面当子代理。 API易 已同步上线claude-haiku-5-5(同时提供 claude-haiku-5-5-thinking),两档分段计费的每一项都与官网一致。
详细解析
核心特性
价格降约 90%
10 万 tokens 以内输入 $0.10、输出 $0.50 每百万 tokens,Haiku 4.5 为 $1 / $5;官方测算已计入新分词器多出的 token
1M 上下文
100 万 tokens 上下文、128K 最大输出(批处理接口配合 beta 头最高 300K),Haiku 4.5 为 200K / 64K
effort 档位
第一款支持 effort 的 Haiku:
low / medium / high / xhigh / max,默认 medium,自适应思考默认开启标准速度下最快
官方称是 Anthropic 标准速度下最快的模型;Artificial Analysis 实测输出速度约 244 tokens/秒
性能基准(厂商自报)
数据来源:Anthropic 官方发布页
anthropic.com/claude-haiku-5-5(2026 年 10 月 7 日)。表中 Sonnet 5.5 的 FrontierCode 分数为 xhigh effort。数据获取时间:2026 年 10 月 8 日。- 和同价位对手比:在官方列出的每一项上,Haiku 5.5 都高于 OpenAI 的小模型 GPT-6 Luna,Terminal-Bench 4.0 高出一倍多
- 和 Sonnet 5.5 比:电脑操作(OSWorld 72.4% 对 83.9%)约为 Sonnet 5.5 的八成半,知识工作 Elo 落后约 220 分;但 Agent 编程(Terminal-Bench 39.2% 对 70.6%)差距明显,这和官方「复杂编程交给 Sonnet / Opus」的定位一致
- 客户反馈:Box 称其得分比 Haiku 4.5 高 11 分、延迟约减半;Asana 称任务完成延迟降低 30% 以上
独立评测(Artificial Analysis)
开发者须知:从 Haiku 4.5 迁移的破坏性变更
Haiku 5.5 的请求结构和 Sonnet 5.5 / Opus 5.5 对齐,相比 Haiku 4.5 有不少会直接报 400 的变化:
另有几处不会报错、但会改变结果的变化:
- 响应可能以
thinking块开头:自适应思考默认开启,即使请求里没提思考也可能返回思考块。按type取文本块,不要直接读第一个块 - 思考 token 计入
max_tokens:沿用 Haiku 4.5 时设的小max_tokens,可能刚思考完就被截断、一个字都没输出。适当调大或降低 effort - 思考内容默认不返回:需要摘要时设置
thinking: {"type": "adaptive", "display": "summarized"} - 强制工具调用可用:
tool_choice为any或指定工具时不报错(Sonnet 5.5 会报错),但这种情况下模型不思考、直接调工具 - 安全分类器:拒答时返回
stop_reason: "refusal",且官方没有自动回退到其他模型,客户端要自己处理
技术规格
API易 实测结果
2026 年 10 月 8 日(UTC+8)在 API易 上实调,结果如下:关于参数兼容:
temperature / top_p / top_k 这类基础采样参数很容易被客户端或 SDK 默认带上,新模型一废弃,已有代码升级后就会整批报错。为此,API易 可能对这类已废弃的基础参数做兼容处理(忽略而不报错)。所以,某个参数在 API易 上没有按官方文档返回 400,并不代表请求没有到达原厂模型,兼容改变的只是参数的处理方式,模型本身不变。迁移时仍建议按官方要求去掉这三个参数;对输出有疑问,欢迎联系客服核对。实际应用
推荐场景
- 分类、抽取、路由:官方的首要定位。高频、短请求、10 万 tokens 以内,正好落在最便宜的那一档
- 当大模型的子代理:在 Opus 5.5 / Sonnet 5.5 主导的编程或研究流程里,负责检索、汇总、取数这类小任务
- 对话压缩与摘要:长对话压缩、会议纪要、工单摘要,速度快、单价低
- 替换 Haiku 4.5:大多数 Haiku 4.5 负载同价位下能力明显更强、成本更低,但要先按下文核对迁移项
代码示例
Anthropic 原生格式
OpenAI 兼容格式
从 Haiku 4.5 迁移的六步核对
- 改模型名:
claude-haiku-4-5-20251001→claude-haiku-5-5(没有日期后缀) - 重新计 token:新分词器同一段文本多约 30% token,
max_tokens和成本估算都要重算 - 替换思考配置:
budget_tokens改为自适应思考 +effort - 去掉采样参数与预填充:
temperature/top_p/top_k不传,messages以 user 结尾 - 按
type取内容块:响应可能以思考块开头 - 处理拒答:识别
stop_reason: "refusal",必要时自行回退到其他模型
价格与可用性
定价信息
原厂公布价格(单位:美元 / 百万 tokens),按单次请求的输入长度分两档:
Haiku 5.5 两列同时就是 API易 的定价:两档分段、五项计费与官网逐项一致,没有加价。
模型价格与官网对齐,且可能随官网调整;上表仅供参考,具体以顶部导航「模型价格」栏目为准:模型价格。
**我们的定价与官网一致,不在模型价格上加价。**在此之上,部分分组另有折扣,也可叠加充值加赠活动,这部分是我们的让利,与模型本身的定价无关。查看实际扣费请以控制台「缓存计费详情」的实时数据为准,API 回显的 usage 缓存字段不能作为计费依据。
可用分组与端点
ClaudeCode 分组用于 Claude Code 等 Anthropic 原生协议客户端,另有折扣,可与充值加赠叠加。Claude_Enterprise 是 10 月 7 日新增的企业分组(倍率 1.2x,仅走 Anthropic 官方通道),详见 实时动态。协议与分组要配套选:走 Anthropic 原生协议请使用 ClaudeCode 分组,走 OpenAI 兼容协议请使用 default / svip 分组。叠加网站充值活动
可结合 API易 充值加赠活动进一步降低实际成本,详见:充值优惠说明。总结与建议
Claude Haiku 5.5 把小模型的价格又往下压了一个数量级,能力却比 Haiku 4.5 跨了一代:电脑操作接近 Sonnet 5.5,官方列出的各项评测都领先同价位的 GPT-6 Luna。对分类、抽取、摘要、子代理这类跑量负载,它是目前 Claude 家族里最划算的选择。 使用建议:- 正在用 Haiku 4.5 的用户:建议升级,但先按六步核对,尤其是采样参数、预填充和
budget_tokens这三处会直接报 400 - 用 Sonnet / Opus 跑窄任务的用户:把检索、汇总、分类这类子任务拆给 Haiku 5.5,主模型只负责决策,整体成本能降不少
- 控制成本:effort 从
low/medium起步;单次输入尽量控制在 10 万 tokens 以内,避开 5 倍单价的高档
信息来源:Anthropic 官方发布页
anthropic.com/claude-haiku-5-5;Anthropic 开发者文档 platform.claude.com/docs/en/models/haiku-5-5/overview、whats-new-haiku-5-5 与 migration-guide;Artificial Analysis 模型页 artificialanalysis.ai/models/claude-haiku-5-5;MarkTechPost 等媒体报道;「API易 实测结果」一节为 2026 年 10 月 8 日本站实调所得。API易定价以平台实时数据为准。数据获取时间:2026 年 10 月 8 日。