Claude Sonnet 5.5 完全指南
截至 2026-10-08,Claude Sonnet 5.5(模型 ID claude-sonnet-5-5,2026-09-28 发布)的官方价是输入 $2 / 输出 $10 每百万 token;缓存读自 2026-10-07 起由 $0.20 降到 $0.10(基础输入价的 0.05×),缓存写与其他价格不变。上下文 1M、最大输出 128K,输入输出仍与 Sonnet 5 同价。Anthropic 自述它比上一代快 30% 以上、多数工作最多便宜 30%。本页把规格、价格、默认 effort 与五项破坏性变更一次说清。
更新于 2026-10-08
Claude、GPT 与国产模型共用一把 key,按 token 计费;可调型号以 /models 为准。
- 按 token 计费,实时单价见 /models
- 支付宝、微信支付、信用卡、加密货币均可付款
- 充值后自助开通、立刻生效
四个规格与默认值
输入 / 输出(每百万 token)
官方写明与 Sonnet 5 同价。Sonnet 5 的 $2 / $10 已确认为标准价,原定 2026-09-01 涨到 $3 / $15 不会发生。
缓存写 5 分钟 / 1 小时
官方价表这一行的缓存写单价:5 分钟 $2.50、1 小时 $4,2026-10-07 的官方更新日志写明缓存写不变。缓存读自 2026-10-07 起为 $0.10(此前 $0.20),出处是官方更新日志与定价页提示缓存一节。
上下文窗口 / 最大输出
官方模型总表:1M tokens 上下文、128K tokens 最大输出,可靠知识截止 2026 年 6 月。
默认 effort
官方文档的说法是:Claude Code 与官方应用里默认 Medium,Claude 平台默认 High;effort 可自行显式设置。
它在家族里的位置
官方发布页称 Sonnet 5.5 是 Claude 5.5 家族里发布的第二个模型(第一个是 2026-09-22 发布的 Opus 5.5;Haiku 5.5 已于 2026-10-07 发布)。分工的官方说法是:需要谨慎判断的复杂工作交给 Opus 5.5,而「well-scoped everyday tasks, fixing bugs, and creating polished documents, slides, and spreadsheets」——范围清楚的日常任务、修 bug、做文档幻灯片和表格——才是它的强项。价格不是卖点而是持平:发布时官方写明输入 $2、输出 $10、缓存读 $0.20 与 Sonnet 5 同价,Batch 档是 $1 / $5;2026-10-07 起它的缓存读降到 $0.10,输入输出仍与 Sonnet 5 相同。Sonnet 5 也没有被弃用,截至 2026-10-08 官方弃用表两行都标 Active。
官方口径(2026-09-28 发布)
官方发布页写道 Sonnet 5.5「runs 30%+ faster, and costs up to 30% less for most work」,成本一节又写「In our testing, it costs up to 30% less per task than its predecessor」——两者都是 Anthropic 自述与自测,不是第三方测量。Claude Code 变更日志 2.1.284 把 claude-sonnet-5-5 标为「now the default Sonnet model on the Anthropic API」:这是 Claude Code 这个客户端在 Anthropic API 上的默认选择,不等于 API 本身设有默认模型。2026-10-07 官方发布 Claude Haiku 5.5(claude-haiku-5-5),同一篇发布文写明把 Sonnet 5.5 的缓存读价格减半,官方称这让 Sonnet 5.5 在多数 agent 类工作上便宜约 20%。
Sonnet 5.5 的时间线
Claude Opus 5.5 发布;官方 Opus 5.5 页把 Sonnet 5.5 与 Haiku 5.5 列为同家族的后续型号,两款已分别于 2026-09-28 与 2026-10-07 发布。
Claude Sonnet 5.5 发布,官方写明与 Sonnet 5 同价;Claude Code 2.1.284 起默认 Sonnet 换成它。
官方更新日志:Sonnet 5.5 的提示缓存读由每百万 token $0.20 降到 $0.10,即基础输入价的 0.05×(原为 0.1×),缓存写与其他价格不变;同日 Claude Haiku 5.5 发布。
已确认 vs 没有核实到的
已确认(官方页逐字可核)
以下都是已确认项,能在官方文档与价表里逐字核到:2026-09-28 发布、ID claude-sonnet-5-5、1M / 128K、输入 $2 / 输出 $10、缓存读 $0.10(2026-10-07 起,此前 $0.20;出自更新日志与定价页提示缓存一节)、缓存写 $2.50 与 $4、Batch $1 / $5、发布时官方写明与 Sonnet 5 同价、默认 effort(平台 high、Claude Code 与 App medium)、五项破坏性变更、Claude Code 2.1.284 的默认档变更。速度、效率与分数类表述同样出自官方页,但那是厂商自述与 Anthropic 自测。另有一条不是厂商公布、而是站内当日实测:截至 2026-09-29,claude-sonnet-5-5 已在 QCode 开通可调。
未证实与官方未公布
两件事没有核实到,别按它们排计划:① 官方称快 30% 以上、单任务最多便宜 30%,以及缓存读减半后多数 agent 类工作便宜约 20%,这些只有 Anthropic 自己的测量,本页没有核到第三方复现;② 网上流传的对比数字与截图,一手源里没有,本页一律不写。另需注意:2026-10-08 抓取时,官方定价页的模型主价表与 Sonnet 5.5 概览页价格表里,Sonnet 5.5 的缓存读一格仍印着 $0.20,与 2026-10-07 更新日志和同一定价页提示缓存一节的 $0.10 不一致,本页按更新日志写 $0.10。原先列在这里的 Haiku 5.5 已于 2026-10-07 发布(claude-haiku-5-5),不再是未公布项。
和 Sonnet 5、Opus 5.5 怎么比
对 Sonnet 5
发布时官方写明输入 $2 / 输出 $10 / 缓存读 $0.20 与 Sonnet 5 同价;2026-10-07 起 Sonnet 5.5 的缓存读降到 $0.10,Sonnet 5 仍是 $0.20,输入输出两者相同。差别在效率与行为:Anthropic 自测 Terminal-Bench 4.0 上 Sonnet 5.5 为 70.6%、Sonnet 5 为 10.3%,官方称快 30% 以上。真正要动手的是五项破坏性变更。
对 Opus 5.5
官方把 Opus 5.5 留给需要谨慎判断的复杂工作,两者是分工不是强弱。按官方价表换算:Sonnet 5.5 的输入输出都是 Opus 5.5 的一半($2 / $10 对 $4 / $20)。缓存读自 2026-10-07 起 Sonnet 5.5 为 $0.10、Opus 5.5 为 $0.20,官方定价页写明两者的缓存命中都是标准输入价的 5%。
换过来要查的五处
官方文档写明「Five breaking changes affect code already running on Claude Sonnet 5」:① 可用 between_tools 关掉预先思考;② 强制 tool use 返回错误;③ thinking 块与产生它的模型和会话绑定;④ Claude API 与 Google Cloud 不接受较早的 computer_20251124 电脑使用工具;⑤ advisor 工具拒绝 Claude Opus 4.8、Claude Opus 4.7 与 Claude Sonnet 5 作为顾问。另有一处不报错但改变响应形态:工具调用之间的文本会回到 thinking 块里。
在 QCode 上
claude-sonnet-5-5 自 2026-09-29 起在 QCode 可调(官方标价 $2 / $10,缓存读 2026-10-07 起为 $0.10)。调用方法:在控制台复制一把 key,接口地址填 QCode 的 Anthropic 兼容端点,model 填 claude-sonnet-5-5,其余参数照旧。同一把 key 也能调 claude-sonnet-5 与 claude-opus-5-5,切换只改 model,端点与 key 都不变。按 token 计费,各模型单价见 /models。
常见问题
claude-sonnet-5-5 的 ID 各平台怎么写?
Claude API、Google Cloud、Microsoft Foundry 与 Claude Platform on AWS 上都是 claude-sonnet-5-5,Amazon Bedrock 上是 anthropic.claude-sonnet-5-5。官方总表里的 Claude API alias 也是 claude-sonnet-5-5,不带日期后缀;弃用表标它 Active,退役不早于 2027-09-28。
Sonnet 5.5 多少钱?和 Sonnet 5 一样吗?
输入输出一样,缓存读更便宜。官方价表里 Sonnet 5.5 这一行写的是:输入 $2、5 分钟缓存写 $2.50、1 小时缓存写 $4、输出 $10 每 MTok;Batch 档 $1 / $5。缓存读:官方 2026-10-07 更新日志写明由 $0.20 降到 $0.10(基础输入价的 0.05×),缓存写与其他价格不变,而 Sonnet 5 的缓存读仍是 $0.20;2026-10-08 抓取时价表这一行的缓存读一格仍印着 $0.20,本页按更新日志与定价页提示缓存一节写 $0.10。发布时官方写明的是输入、输出、缓存读三项与 Sonnet 5 同价。另一条:Sonnet 5 原定 2026-09-01 上调至 $3 / $15,官方价表脚注写明不会发生。
它比 Sonnet 5 快多少、便宜多少?
官方称「runs 30%+ faster」,并说测试中「it costs up to 30% less per task than its predecessor」。这是 Anthropic 自述。官方发布页还载有其他自测分数,本页一律不转录;这里引的 Terminal-Bench 4.0 的 70.6% 对 10.3% 同样是 Anthropic 自测,没有第三方审计。标价上输入、输出与 Sonnet 5 相同,缓存读 2026-10-07 起更低($0.10 对 $0.20);官方称缓存读减半后 Sonnet 5.5 在多数 agent 类工作上便宜约 20%,同样是厂商自述。你实际省多少取决于自己的 token 用量与缓存命中。
从 Sonnet 5 换过去要改代码吗?
可能要。官方列了五项破坏性变更(见上一节),最容易撞到的是思考相关两处:显式关思考会直接报错;between_tools 只在 low、medium、high 三档 effort 下被接受,在 xhigh 或 max 返回 400 错误,要在那两档跑就得改用自适应思考。
关掉思考会报什么错?
官方迁移文档给出的原文是:"thinking.type.disabled" is not supported for this model. Use "thinking.type.between_tools" for the lowest thinking setting, or "thinking.type.adaptive" and "output_config.effort" to control thinking behavior. 最低档思考改用 between_tools,要控制思考行为就走 adaptive 加 effort,不要再发 disabled。
现在能在 QCode 上调它吗?
能。claude-sonnet-5-5 自 2026-09-29 起在 QCode 可调。你手上这把 key 照旧能切 claude-sonnet-5 与 claude-opus-5-5,改的只有 model;按 token 计费,当前型号与单价以 /models 为准。
信息来源
规格与变更清单:Anthropic 官方文档的 Claude Sonnet 5.5 概览页与模型总表(2026-09-29 首次抓取,2026-10-08 复核发布日、模型 ID、上下文与最大输出、各平台 ID)。价格:官方定价页,Sonnet 5.5 与 Sonnet 5、Opus 5.5 各档的输入、输出与缓存写单价、Batch 档与 Sonnet 5 涨价取消的脚注都出自这份表;2026-10-07 起的缓存读 $0.10 出自 Claude Platform 更新日志 2026-10-07 条目与定价页提示缓存一节(2026-10-08 抓取)。定位与自述:官方发布页 claude-sonnet-5-5(速度成本自述、Terminal-Bench 4.0 的 Anthropic 自测分数)与 2026-10-07 的 Claude Haiku 5.5 发布页(缓存读减半、约 20% 的厂商自述)。报错原文与 between_tools 的 effort 限制:官方迁移指南。默认 Sonnet 的变更:Claude Code 变更日志 2.1.284。
相关阅读
Claude Sonnet 5 完全指南
同价的上一代:规格、价表与路由建议。
Claude Sonnet 5 价格与每 token 成本
逐项单价、已取消的 2026-09-01 上调与缓存计价。
Claude Opus 5.5 完全指南
官方留给复杂工作的那一档:$4 / $20、缓存读 $0.20。
本页价格与规格核对于 2026-10-08,引语与 Claude Code 相关内容核对于 2026-09-29,以 Anthropic 官方文档与价表为准,上游调整不另行通知。速度、成本与分数类数字都是厂商自述或自测,不是第三方审计,也不构成对你具体工作负载的承诺。模型可用性以 /models 与你的实测为准。