核心要点
- Sonnet 档价格,Opus 档能力:官方公布 Terminal-Bench 4.0 得分 70.6%,高于 Opus 5.5 的 66.4%;GDPval-AA 知识工作 1844,与 Opus 5.5 的 1846 基本持平
- 价格不变:输入 $2 / 输出 $10 每百万 tokens,缓存读取 $0.20,与 Sonnet 5 完全相同,只有 Opus 5.5 的一半
- 更快、更省 token:官方口径是生成速度比 Sonnet 5 快 30% 以上,完成同样任务用的 token 更少,单任务成本最多低约 30%
- API易 已上线:
claude-sonnet-5-5与claude-sonnet-5-5-thinking,OpenAI 兼容与 Anthropic 原生双端点,四项计费与官网逐项一致 - 五项破坏性变更:
thinking: disabled报 400(改用between_tools)、强制工具调用报 400、思考块与模型和会话绑定、电脑操作只认新工具集、advisor 搭配收紧;另外top_p/top_k不再支持,API易 实测传了会直接报错
背景介绍
2026 年 9 月 28 日,Anthropic 发布 Claude Sonnet 5.5,这是 Claude 5.5 系列的第二款模型,排在一周前上线的 Opus 5.5 之后。官方同时表示 Haiku 5.5 会在未来几周推出。 Sonnet 系列的定位一直是「日常主力」:速度快、价格适中。三个月前的 Sonnet 5 已经把能力推到接近 Opus 4.8,而这一次 Sonnet 5.5 与 Opus 5.5 同源训练,在 Agent 编程上反超了自家旗舰,知识工作基准也只差 2 分,价格却只有 Opus 5.5 的一半。 官方把它最擅长的方向概括为:范围明确的日常任务、修 Bug,以及产出成品质量的文档、幻灯片与表格。它也是第一款只看屏幕截图就通关《宝可梦 红》的 Sonnet 模型,官方以此说明其长周期任务与图像理解能力。 API易 已同步上线claude-sonnet-5-5(同时提供 claude-sonnet-5-5-thinking),输入、输出、缓存写入、缓存读取四项计费全部与官网一致。
详细解析
核心特性
Agent 编程超过 Opus 5.5
Terminal-Bench 4.0 官方分 70.6%,高于 Opus 5.5 的 66.4%;CursorBench 4.0 从 Sonnet 5 的 34.1% 升到 55.5%
更快、更少 token
生成速度比 Sonnet 5 快 30% 以上;早期测试者反馈它会把工具调用合并成更少的步骤
1M 上下文
100 万 tokens 上下文,128K 最大输出,分词器与 Sonnet 5 相同,同一段文本 token 数不变
知识工作追平旗舰
GDPval-AA 1844、AA-Briefcase 1811,与 Opus 5.5(1846 / 1822)几乎持平,比 Sonnet 5 高出约 400 分
性能基准(厂商自报)
数据来源:Anthropic 官方发布页
anthropic.com/claude-sonnet-5-5(2026 年 9 月 28 日)。官方脚注:Opus 5.5 的 Terminal-Bench 分数为 xhigh effort,FrontierCode 为 max effort;GPT-6 Sol 的部分分数因对方近期修复 bug 已过时。数据获取时间:2026 年 9 月 30 日。独立评测(Artificial Analysis)
同一项基准,独立评测给出的分数比厂商自报低,但相对排序一致:开发者须知:破坏性变更
Sonnet 5.5 沿用 Sonnet 5 的请求结构,但下面几处会直接报错或改变响应形状,迁移前务必核对:
另有两处不会导致报错的变化:
- 工具调用之间的进度文字改走
thinking块:默认display: "omitted"时内容为空,如果你的界面会把这段文字流式展示给用户,切换后会在工具调用之间「沉默」;改用between_tools或设置thinking.display即可恢复 - 安全分类器:拒答时返回 HTTP 200 +
stop_reason: "refusal",stop_details分五类(cyber/bio/frontier_llm/reasoning_extraction/general_harms)。这是第一款带网络安全与防蒸馏分类器的 Sonnet,网络安全类高风险请求会由官方回退到 Sonnet 5 处理
技术规格
API易 实测结果
2026 年 9 月 30 日(UTC+8)在 API易 上实调,结果如下:
最后两行说明了成本差异:同一个模型,简单问题几乎不产生思考 token,难题在
max 档下一次就能思考近万 tokens。effort 档位对账单的影响远大于单价。
实际应用
推荐场景
- 日常主力编程:修 Bug、仓库级小改动、终端类 Agent 任务,Terminal-Bench 4.0 是这次提升最大的方向
- 文档、幻灯片与表格产出:官方重点强调的方向,AA-Briefcase 与 GDPval-AA 都接近 Opus 5.5
- 高频 Agent 与客服流程:速度更快、工具调用步骤更少,适合对延迟敏感的多轮工具调用
- 替换 Sonnet 5 与部分 Opus 5.5 负载:同价升级 Sonnet 5;Opus 5.5 上范围明确的任务可以先切过来评测,成本约为一半
代码示例
Anthropic 原生格式
关闭前置思考(替代原来的 disabled)
OpenAI 兼容格式
从 Sonnet 5 迁移的六步核对
- 改模型名:
claude-sonnet-5→claude-sonnet-5-5 - 替换关闭思考的配置:
thinking: {"type": "disabled"}改为between_tools,且 effort 不能超过high - 删掉强制工具调用:
tool_choice改为auto,配合strict: true保证入参合法 - 去掉采样参数:
top_p/top_k会直接报错,temperature不生效,三个都不要传;手动思考预算budget_tokens也不再使用,改用effort控制思考深度 - 重新校准 effort:同一档位的思考量和 Sonnet 5 不同,建议重新跑一遍评测,不要沿用旧设置
- 保证历史只追加:思考块原样回传,别在请求之间改
system/tools/ 更早的消息
价格与可用性
定价信息
原厂公布价格(单位:美元 / 百万 tokens):
Sonnet 5.5 一列同时就是 API易 的定价:四项计费与官网逐项一致,没有加价。
模型价格与官网对齐,且可能随官网调整;上表仅供参考,具体以顶部导航「模型价格」栏目为准:模型价格。
**我们的定价与官网一致,不在模型价格上加价。**在此之上,部分分组另有折扣,也可叠加充值加赠活动,这部分是我们的让利,与模型本身的定价无关。查看实际扣费请以控制台「缓存计费详情」的实时数据为准,API 回显的 usage 缓存字段不能作为计费依据。
可用分组与端点
ClaudeCode 分组用于 Claude Code 等 Anthropic 原生协议客户端。协议与分组要配套选:走 Anthropic 原生协议请使用 ClaudeCode 分组,走 OpenAI 兼容协议请使用 default / svip 分组。该分组另有折扣,可与充值加赠叠加。叠加网站充值活动
可结合 API易 充值加赠活动进一步降低实际成本,详见:充值优惠说明。总结与建议
Claude Sonnet 5.5 是一次「同价升级」:价格与 Sonnet 5 完全一样,Agent 编程反超 Opus 5.5,知识工作与旗舰只差 2 分,速度还快了三成。对大多数日常编程与文档类负载,它是目前 Claude 家族里性价比最高的选择。 使用建议:- 正在用 Sonnet 5 的用户:直接升级,但先按上面六步核对,尤其是
disabled→between_tools、强制工具调用和采样参数这三处 - 正在用 Opus 5.5 的用户:范围明确的编程与文档任务可以先切到 Sonnet 5.5 评测,成本约为一半;复杂架构决策与长链路研究仍建议留在 Opus 5.5
- 控制成本:effort 不要默认拉到
max,从medium/high起步,看效果再上调
信息来源:Anthropic 官方发布页
anthropic.com/claude-sonnet-5-5;Anthropic 开发者文档 platform.claude.com/docs/en/models/sonnet-5-5/overview 与 whats-new-sonnet-5-5;Artificial Analysis 独立评测(转引自 Decrypt);SiliconANGLE、Unite.AI、Help Net Security 等媒体报道;「API易 实测结果」一节为 2026 年 9 月 30 日本站实调所得。API易定价以平台实时数据为准。数据获取时间:2026 年 9 月 30 日。