Skip to main content

核心要点

  • Sonnet 档价格,Opus 档能力:官方公布 Terminal-Bench 4.0 得分 70.6%,高于 Opus 5.5 的 66.4%;GDPval-AA 知识工作 1844,与 Opus 5.5 的 1846 基本持平
  • 价格不变:输入 $2 / 输出 $10 每百万 tokens,缓存读取 $0.20,与 Sonnet 5 完全相同,只有 Opus 5.5 的一半
  • 更快、更省 token:官方口径是生成速度比 Sonnet 5 快 30% 以上,完成同样任务用的 token 更少,单任务成本最多低约 30%
  • API易 已上线:claude-sonnet-5-5 与 claude-sonnet-5-5-thinking,OpenAI 兼容与 Anthropic 原生双端点,四项计费与官网逐项一致
  • 五项破坏性变更:thinking: disabled 报 400(改用 between_tools)、强制工具调用报 400、思考块与模型和会话绑定、电脑操作只认新工具集、advisor 搭配收紧;另外 top_p / top_k 不再支持,API易 实测传了会直接报错

背景介绍

2026 年 9 月 28 日,Anthropic 发布 Claude Sonnet 5.5,这是 Claude 5.5 系列的第二款模型,排在一周前上线的 Opus 5.5 之后。官方同时表示 Haiku 5.5 会在未来几周推出。 Sonnet 系列的定位一直是「日常主力」:速度快、价格适中。三个月前的 Sonnet 5 已经把能力推到接近 Opus 4.8,而这一次 Sonnet 5.5 与 Opus 5.5 同源训练,在 Agent 编程上反超了自家旗舰,知识工作基准也只差 2 分,价格却只有 Opus 5.5 的一半。 官方把它最擅长的方向概括为:范围明确的日常任务、修 Bug,以及产出成品质量的文档、幻灯片与表格。它也是第一款只看屏幕截图就通关《宝可梦 红》的 Sonnet 模型,官方以此说明其长周期任务与图像理解能力。 API易 已同步上线 claude-sonnet-5-5(同时提供 claude-sonnet-5-5-thinking),输入、输出、缓存写入、缓存读取四项计费全部与官网一致。

详细解析

核心特性

Agent 编程超过 Opus 5.5

Terminal-Bench 4.0 官方分 70.6%,高于 Opus 5.5 的 66.4%;CursorBench 4.0 从 Sonnet 5 的 34.1% 升到 55.5%

更快、更少 token

生成速度比 Sonnet 5 快 30% 以上;早期测试者反馈它会把工具调用合并成更少的步骤

1M 上下文

100 万 tokens 上下文,128K 最大输出,分词器与 Sonnet 5 相同,同一段文本 token 数不变

知识工作追平旗舰

GDPval-AA 1844、AA-Briefcase 1811,与 Opus 5.5(1846 / 1822)几乎持平,比 Sonnet 5 高出约 400 分

性能基准(厂商自报)

数据来源:Anthropic 官方发布页 anthropic.com/claude-sonnet-5-5(2026 年 9 月 28 日)。官方脚注:Opus 5.5 的 Terminal-Bench 分数为 xhigh effort,FrontierCode 为 max effort;GPT-6 Sol 的部分分数因对方近期修复 bug 已过时。数据获取时间:2026 年 9 月 30 日。

独立评测(Artificial Analysis)

同一项基准,独立评测给出的分数比厂商自报低,但相对排序一致:
单价低不等于单任务便宜:Artificial Analysis 测得 Sonnet 5.5 在 max effort 下平均每个测试任务消耗约 19.3 万 tokens,是其测过的模型里最高的。Sonnet 5.5 的默认 effort 是 high,如果你一路开到 xhigh / max,token 用量上涨会抵消单价优势。日常任务建议从 medium 或 high 起步,不要默认拉满。

开发者须知:破坏性变更

Sonnet 5.5 沿用 Sonnet 5 的请求结构,但下面几处会直接报错或改变响应形状,迁移前务必核对:
top_p / top_k 会报错:官方文档写明 Sonnet 5.5 不接受非默认的 temperature / top_p / top_k。API易 实测(2026-09-30):top_p、top_k 在 Anthropic 原生与 OpenAI 兼容两个端点都会被拒,报错信息为 `top_p` is deprecated for this model,状态码显示为 429 但不是限流,重试无效,去掉参数即可;temperature 传任意值都正常返回 200,但不会生效。建议切换前在客户端里把这三个参数一并去掉。
另有两处不会导致报错的变化:
  • 工具调用之间的进度文字改走 thinking 块:默认 display: "omitted" 时内容为空,如果你的界面会把这段文字流式展示给用户,切换后会在工具调用之间「沉默」;改用 between_tools 或设置 thinking.display 即可恢复
  • 安全分类器:拒答时返回 HTTP 200 + stop_reason: "refusal",stop_details 分五类(cyber / bio / frontier_llm / reasoning_extraction / general_harms)。这是第一款带网络安全与防蒸馏分类器的 Sonnet,网络安全类高风险请求会由官方回退到 Sonnet 5 处理

技术规格

API易 实测结果

2026 年 9 月 30 日(UTC+8)在 API易 上实调,结果如下: 最后两行说明了成本差异:同一个模型,简单问题几乎不产生思考 token,难题在 max 档下一次就能思考近万 tokens。effort 档位对账单的影响远大于单价。

实际应用

推荐场景

  1. 日常主力编程:修 Bug、仓库级小改动、终端类 Agent 任务,Terminal-Bench 4.0 是这次提升最大的方向
  2. 文档、幻灯片与表格产出:官方重点强调的方向,AA-Briefcase 与 GDPval-AA 都接近 Opus 5.5
  3. 高频 Agent 与客服流程:速度更快、工具调用步骤更少,适合对延迟敏感的多轮工具调用
  4. 替换 Sonnet 5 与部分 Opus 5.5 负载:同价升级 Sonnet 5;Opus 5.5 上范围明确的任务可以先切过来评测,成本约为一半

代码示例

Anthropic 原生格式

关闭前置思考(替代原来的 disabled)

OpenAI 兼容格式

从 Sonnet 5 迁移的六步核对

  1. 改模型名:claude-sonnet-5 → claude-sonnet-5-5
  2. 替换关闭思考的配置:thinking: {"type": "disabled"} 改为 between_tools,且 effort 不能超过 high
  3. 删掉强制工具调用:tool_choice 改为 auto,配合 strict: true 保证入参合法
  4. 去掉采样参数:top_p / top_k 会直接报错,temperature 不生效,三个都不要传;手动思考预算 budget_tokens 也不再使用,改用 effort 控制思考深度
  5. 重新校准 effort:同一档位的思考量和 Sonnet 5 不同,建议重新跑一遍评测,不要沿用旧设置
  6. 保证历史只追加:思考块原样回传,别在请求之间改 system / tools / 更早的消息

价格与可用性

定价信息

原厂公布价格(单位:美元 / 百万 tokens): Sonnet 5.5 一列同时就是 API易 的定价:四项计费与官网逐项一致,没有加价。
模型价格与官网对齐,且可能随官网调整;上表仅供参考,具体以顶部导航「模型价格」栏目为准:模型价格。
**我们的定价与官网一致,不在模型价格上加价。**在此之上,部分分组另有折扣,也可叠加充值加赠活动,这部分是我们的让利,与模型本身的定价无关。查看实际扣费请以控制台「缓存计费详情」的实时数据为准,API 回显的 usage 缓存字段不能作为计费依据。

可用分组与端点

ClaudeCode 分组用于 Claude Code 等 Anthropic 原生协议客户端。协议与分组要配套选:走 Anthropic 原生协议请使用 ClaudeCode 分组,走 OpenAI 兼容协议请使用 default / svip 分组。该分组另有折扣,可与充值加赠叠加。
Sonnet 5.5 支持零数据保留,不受 Fable 系列 30 天数据保留要求的限制。

叠加网站充值活动

可结合 API易 充值加赠活动进一步降低实际成本,详见:充值优惠说明。

总结与建议

Claude Sonnet 5.5 是一次「同价升级」:价格与 Sonnet 5 完全一样,Agent 编程反超 Opus 5.5,知识工作与旗舰只差 2 分,速度还快了三成。对大多数日常编程与文档类负载,它是目前 Claude 家族里性价比最高的选择。 使用建议:
  1. 正在用 Sonnet 5 的用户:直接升级,但先按上面六步核对,尤其是 disabled → between_tools、强制工具调用和采样参数这三处
  2. 正在用 Opus 5.5 的用户:范围明确的编程与文档任务可以先切到 Sonnet 5.5 评测,成本约为一半;复杂架构决策与长链路研究仍建议留在 Opus 5.5
  3. 控制成本:effort 不要默认拉到 max,从 medium / high 起步,看效果再上调
信息来源:Anthropic 官方发布页 anthropic.com/claude-sonnet-5-5;Anthropic 开发者文档 platform.claude.com/docs/en/models/sonnet-5-5/overview 与 whats-new-sonnet-5-5;Artificial Analysis 独立评测(转引自 Decrypt);SiliconANGLE、Unite.AI、Help Net Security 等媒体报道;「API易 实测结果」一节为 2026 年 9 月 30 日本站实调所得。API易定价以平台实时数据为准。数据获取时间:2026 年 9 月 30 日。