Anthropic 于 2026 年 9 月 28 日发布的 Claude Sonnet 5.5 已在 Router One 目录上架,目录 id 是 anthropic/claude-sonnet-5.5(2026-09-29 上架);网关同时接受 Anthropic 官方 id claude-sonnet-5-5。国内开发者不需要海外账号、不需要 VPN:用 Router One 的 Key 向 https://api.router.one/v1/messages 发 "model": "claude-sonnet-5-5",或者把 OpenAI 兼容客户端的 base URL 换成 https://api.router.one/v1,请求就会像目录里其他模型一样被路由、计费并记入日志。2026-09-30 的套餐接口里 Pro、Max、Ultra 都没有档位列出它,所以每次调用都按 token 从钱包扣费;实时单价看 Claude Sonnet 5.5 模型页。
本文依次讲清:目录对这个 id 公开了什么,Anthropic 怎么定位它,Claude Sonnet 5.5、Claude Sonnet 5 与 Claude Opus 5.5 之间怎么选,费用和套餐怎么算,Claude Code 2.1.284 改了什么,两个端点上的第一个请求怎么发,以及从 Claude Sonnet 5 迁过来要改哪些代码。文中的目录与套餐信息都注明了观察日期,发起新请求前以实时目录为准。
Claude Sonnet 5.5 速览
| 项目 | 目录所列(2026-09-30) |
|---|---|
| 目录 id | anthropic/claude-sonnet-5.5,2026-09-29 上架 |
| 短 id(别名) | claude-sonnet-5-5,即 Anthropic 官方模型 id |
| 上下文窗口 | 1,048,576 token |
| 输入 / 输出 | 文本、图像输入,文本输出 |
| 能力标签 | chat、streaming、tool calling、vision |
| 价格线 | 一条,覆盖整个窗口,没有长上下文阶梯 |
| 端点 | POST /v1/messages(Anthropic 原生,推荐)与 POST /v1/chat/completions |
| 不在此端点服务 | POST /v1/responses |
| 渠道 | 只在默认渠道提供,没有 aws/、vertex/ 或 azure/ 版本 |
| 套餐 | Pro、Max、Ultra 都没有档位列出(2026-09-30 套餐接口),按钱包计费 |
Anthropic 官方的 Claude Sonnet 5.5 概览页(2026-09-30 核对)给出的是 Anthropic 自己的规格:发布日期为 2026 年 9 月 28 日,上下文 1M token,同步 Messages API 下最多输出 128K token,可靠知识截止 2026 年 6 月,官方称它是 "the best combination of speed and intelligence"(速度与智能的最佳组合)。自适应思考默认开启,最低一档 between_tools 会关闭前置思考;思考深度由 output_config.effort 控制,可取 low、medium、high、xhigh 与 max,API 默认 high(effort 文档)。以上是厂商的说法;Router One 负责的是目录条目本身,以及网关如何路由和计费。
选 Claude Sonnet 5.5、Sonnet 5 还是 Opus 5.5?
按 Anthropic 的发布说明(2026 年 9 月 28 日),Claude Sonnet 5.5 是 Claude 5.5 系列的第二个模型,相对 Claude Sonnet 5 是 "a clear upgrade"(明确的升级),输出速度快 30% 以上;它被定位为 "a faster, lower-cost complement to Claude Opus 5.5"(比 Claude Opus 5.5 更快、成本更低的补充):Opus 5.5 面向需要审慎判断的复杂工作,Sonnet 5.5 最擅长范围明确的日常任务、修复 bug,以及制作精致的文档、幻灯片和表格。同一页也写明,在需要持续判断的复杂开放式工作上,Opus 5.5 "remains clearly stronger"(仍明显更强)。Anthropic 公布的基准分数:Terminal-Bench 4.0 上 Claude Sonnet 5.5 为 70.6%(Claude Sonnet 5 为 10.3%,Claude Opus 5.5 在 xhigh 思考强度下为 66.4%),CursorBench 4.0 上为 55.5%(Claude Sonnet 5 为 34.1%,Claude Opus 5.5 为 57.8%)。这些是 Anthropic 的结果,不是 Router One 的测量;把一类任务迁过去之前,先用你自己的提示词跑一遍。
Router One 这一侧,选择时还要看三点:
- 套餐额度还是钱包。 Claude Sonnet 5 仍在三个套餐的「中级模型」档,请求消耗套餐额度;Claude Sonnet 5.5 与 Claude Opus 5.5 都不在任何套餐档位,调用从钱包扣费。Anthropic 已把 Claude Sonnet 5 标为 legacy(旧版)模型,写明它 "still available"(仍可使用),退役时间不早于 2027 年 6 月 30 日(模型弃用页)。
- 公示单价。 Router One 为每个模型单独公示单价,Claude Sonnet 5.5 与 Claude Sonnet 5 的公示单价不同。下面的对比页会渲染实时数字,切换前请重新核算成本。
- 中途换模型。 按 Anthropic 文档,Claude Sonnet 5.5 能读取 Claude Sonnet 5 的 thinking 块,读不了 Claude Opus 5、Claude Opus 5.5 以及任何 Claude Fable 模型的;其他模型也都读不了 Claude Sonnet 5.5 写出的 thinking 块。所以对话从 Sonnet 5 换到 Sonnet 5.5 时推理得以延续;在 Sonnet 5.5 与 Opus 5.5 之间切换(任一方向)时,切换之后的轮次会丢掉此前模型的推理。
三个对比页用实时目录把规格和单价并排渲染出来:
- Claude Sonnet 5.5 vs Claude Sonnet 5——代际升级,以及钱包计费与「中级模型」套餐额度怎么取舍。
- Claude Sonnet 5.5 vs Claude Opus 5.5——同一类任务用 Sonnet 还是 Opus,两者都按钱包计费。
- Claude Opus 5.5 vs Claude Sonnet 5——继续用 Claude Sonnet 5 的话看这一页。
费用怎么算
模型页公示输入与输出单价,适用于整个 1,048,576 token 窗口:目录没有给 Claude Sonnet 5.5 设长上下文阶梯,一次几乎填满窗口的请求和一次短请求按同一条价格线计费。
自适应思考默认开启,由模型按思考强度决定想多少。思考 token 按输出 token 计,适用模型公示的输出单价(价格事实页);响应里不返回思考文本时(默认的 display: "omitted" 正是如此)也照样计费(Anthropic 思考文档)。所以思考强度既是质量旋钮,也是成本旋钮。Anthropic 重新校准了这个模型的各档强度,同一档产生的思考量与 Claude Sonnet 5 不同;API 默认 high,Claude Code 默认 medium。先按任务比较几档,再定默认值。
本文不印每 token 单价,因为它会过时。实时单价看 Claude Sonnet 5.5 模型页,上面的对比页会渲染它与 Claude Sonnet 5、Claude Opus 5.5 之间的价差。
订阅套餐覆盖 Claude Sonnet 5.5 吗?
不覆盖。2026-09-30 的套餐接口里,Pro、Max、Ultra 的任何档位都没有列出 claude-sonnet-5-5,所以不论是否持有套餐,Claude Sonnet 5.5 的调用都按 token 从钱包余额扣费,单价以模型页公示为准。Claude Sonnet 5 仍在三个套餐的「中级模型」档(输入超过其长上下文阈值的请求会按多次套餐请求计),Claude Opus 5.5 同样不在任何档位。套餐的模型列表会调整,实时列表与额度规则以价格页为准。
影响最大的是 Claude Code。
Claude Code:sonnet 别名现在发出 claude-sonnet-5-5
按 Claude Code 更新日志与模型配置文档(2026-09-30 核对),Claude Code 2.1.284(2026 年 9 月 28 日)把 Anthropic API 上的默认 Sonnet 换成了 Claude Sonnet 5.5:sonnet 别名现在指向它,发出的 ID 是 claude-sonnet-5-5。Claude Code 会把通过 ANTHROPIC_BASE_URL 接入的网关当作 Claude API 对待(网关协议文档),所以指向 Router One 的会话发出的也是这个 ID。Router One 自 2026-09-29 起列出 claude-sonnet-5-5,但 2026-09-30 的套餐接口里 Pro、Max、Ultra 都没有档位列出它,所以用套餐时,凡是经过 sonnet 别名的请求——/model sonnet、定义为 model: sonnet 的子 agent、/statusline 以及 opusplan 的执行阶段——都按 token 从钱包扣费。
别名是在 2.1.284 改的。2026-09-30 时,Claude Code 的 stable 发布通道还停在 2.1.280,sonnet 在那个版本上仍指向 Claude Sonnet 5;默认的 latest 通道是 2.1.285(npm dist-tags)。运行 claude --version 可以确认自己用的是哪个版本。
把别名固定下来:写进 shell 配置文件;如果配置是一键安装脚本写的,就写进 ~/.claude/settings.json 的 env 块——安装脚本只设置 ANTHROPIC_BASE_URL 与 ANTHROPIC_AUTH_TOKEN,不指定模型:
export ANTHROPIC_DEFAULT_SONNET_MODEL=claude-sonnet-5
export ANTHROPIC_DEFAULT_HAIKU_MODEL=claude-haiku-4-5
Sonnet 这一行让这些请求继续消耗套餐额度:sonnet 别名改回 Claude Sonnet 5,而 Claude Sonnet 5 在三个套餐的「中级模型」档;用钱包、想让 sonnet 别名继续用 Claude Sonnet 5.5(按公示单价计费)的,可以去掉这一行。fable 别名无需固定:Claude Code 把它解析到 Claude Fable 5.1(claude-fable-5-1),Router One 于 2026-09-30 重新列出该模型,它与 Claude Fable 5 一样不在任何套餐档位。Haiku 这一行可选,用于让后台任务改用 Claude Haiku 4.5,而不是跟随主模型。套餐用户再设置 ANTHROPIC_MODEL=claude-opus-5 与 ANTHROPIC_DEFAULT_OPUS_MODEL=claude-opus-5,因为默认的 Claude Opus 5.5(claude-opus-5-5)不在任何套餐档位。完整配置见 Claude Code 国内使用与一步步的 Claude Code 配置指南;子 agent 的模型与后台任务,见 Claude Code 默认 Opus 5.5 之后的配置。
按模型配置文档,Claude Code 默认以 medium 思考强度运行这个模型(API 默认是 high),而且不能关闭它的思考,MAX_THINKING_TOKENS=0 对它不起作用。Claude Code 给上下文窗口留多少预算,是客户端的设置:2.1.285 的更新日志写明,通过自定义 ANTHROPIC_BASE_URL 接入的会话,现在会对有 1M 窗口的模型(含 Sonnet 5 及以后)使用 1M 窗口;而模型配置文档(2026-09-30 核对)仍写着,在网关后面要用满窗口,就在模型选择器里选 1M 上下文的 Sonnet,对应 sonnet[1m]。在 Claude Code 里请用官方 id 或 sonnet 别名,不要用目录 id:遇到不认识的 id,Claude Code 会按 200K 窗口处理,还要靠 modelOverrides 才能把它对应到模型的能力(网关协议文档)。
发出第一个请求
- 创建 Key。 控制台 → API 密钥 → 创建密钥,Key 形如
sk-...。试用阶段给这把 Key 设一个maxSpend消费上限:花费不会超过这个上限,其他 Key 照常可用(按 Key 成本追踪)。 - 保证钱包有余额。 不论是否持有套餐,Claude Sonnet 5.5 的调用都从钱包扣费;充值在控制台 → 充值。
- 按客户端选 base URL。 Anthropic 原生 SDK 和工具填
https://api.router.one(SDK 的base_url,或ANTHROPIC_BASE_URL),请求发往它下面的/v1/messages;OpenAI 兼容 SDK 填https://api.router.one/v1。 - 调用模型。 下面的示例都用
claude-sonnet-5-5;直接发 HTTP 请求时,目录 idanthropic/claude-sonnet-5.5同样可用。
Messages API,流式输出,并显式设置思考强度(API 默认为 high;Anthropic 建议范围明确的 Agent 编码从 medium 起步,对话类从 medium 或 low 起步):
curl https://api.router.one/v1/messages \
-H "x-api-key: sk-your-api-key" \
-H "anthropic-version: 2023-06-01" \
-H "content-type: application/json" \
-d '{
"model": "claude-sonnet-5-5",
"max_tokens": 16000,
"stream": true,
"output_config": {"effort": "medium"},
"messages": [{"role": "user", "content": "找出这个函数里的 bug,并给出改动最小的修复。"}]
}'
用 Anthropic Python SDK 调用(请用新版 SDK:pip install -U anthropic),只需要改 base_url 和 Key。响应可能以一个或多个 thinking 块开头,所以要按块的类型读取内容,不要按位置取:
import anthropic
client = anthropic.Anthropic(
base_url="https://api.router.one",
api_key="sk-your-api-key",
)
with client.messages.stream(
model="claude-sonnet-5-5",
max_tokens=16000,
output_config={"effort": "medium"},
messages=[{"role": "user", "content": "找出这个函数里的 bug,并给出改动最小的修复。"}],
) as stream:
message = stream.get_final_message()
for block in message.content:
if block.type == "text":
print(block.text)
print(message.stop_reason, message.usage)
Chat Completions,给 OpenAI 兼容客户端用,同样显式设置 max_tokens 并开启流式:
curl https://api.router.one/v1/chat/completions \
-H "Authorization: Bearer sk-your-api-key" \
-H "Content-Type: application/json" \
-d '{
"model": "claude-sonnet-5-5",
"max_tokens": 16000,
"stream": true,
"messages": [{"role": "user", "content": "找出这个函数里的 bug,并给出改动最小的修复。"}]
}'
两个端点通用的几条规则:
- 每个请求都显式设置
max_tokens。 思考和正文共用这个上限(Anthropic 迁移指南),不要依赖默认值,要给两者都留出空间。Router One 的 Chat Completions 参考文档把max_tokens写作输出上限;客户端允许选择时,请发送max_tokens。 - 长任务用流式。
stream: true让输出边生成边返回,不必一直等整段长回答完成(流式输出指南)。 - 保持充足的钱包余额。 请求执行前,网关会按预估额从余额中预留;余额不够时,网关会把
max_tokens调低到余额能覆盖的数值,长回答可能因此被截断。 - 不要传非默认的
temperature、top_p、top_k。 Anthropic 的模型页写明,在这个模型上设成非默认值会返回 400。 - 文件直接内联。 Router One 不提供 Files API:图片以 base64 内容块传入,PDF 请在
/v1/messages上以 base64document块传入,不要用文件引用。
端点怎么选。 调用 Claude Sonnet 5.5 推荐走 /v1/messages:output_config.effort、带 display 选项的 thinking 以及 anthropic-beta 请求头都原样透传,工具循环里要传回给模型的 thinking 块也走这个端点。/v1/chat/completions 能用于普通对话和工具调用,但不转发 anthropic-beta 请求头,也不会跨轮回放思考块,所以多轮工具循环能跑通,却没有推理的连续性;要设置思考强度,请在 /v1/messages 上用 output_config.effort。要 JSON 输出,请用 /v1/messages 加 output_config.format,或者用 strict 工具并把 tool_choice 设为 auto(见 Anthropic 结构化输出文档);Chat Completions 的 response_format 不是从 Claude id 拿到 JSON 的可靠办法。另外,Router One 的 /v1/messages/count_tokens 返回的是本地估算,不是 Anthropic 的计数——实际计费的数字以每次响应里的 usage 为准。
- 看 Trace。 控制台 → 日志里每次调用都带模型、输入输出 token、费用、延迟和状态(每请求可观测)。参数错误导致的 400 不会被重试,也不会换到别的模型:失败的 Claude Sonnet 5.5 请求绝不会被 Claude Sonnet 5 或其他模型悄悄代答。
与 Claude Sonnet 5 相比有哪些变化
Anthropic 的 What's new 页写明了影响现有 Claude Sonnet 5 代码的五项不兼容改动,迁移指南把它们整理成了检查清单(两者均为 2026-09-30 核对)。按 Anthropic 对其 API 的说明,简要来说:
- 关闭思考改用
between_tools。 在 Claude Sonnet 5.5 上,thinking: {"type": "disabled"}会返回 400;改发{"type": "between_tools"}:这是最低一档,会关闭前置思考,仅在low、medium、high思考强度下可用(xhigh、max不行),也不能再带其他字段。手动的budget_tokens预算同样会被拒绝,这一点与 Claude Sonnet 5 相同;思考深度用output_config.effort控制。 - 强制工具调用返回 400。
tool_choice的any与tool会被拒绝,auto(默认)与none可用。要让工具输入符合 schema,就保持auto并用 strict 工具,或者把 schema 移到结构化输出里,并在提示词里写明什么时候该用这个工具。 - 思考块与模型和对话绑定。 把思考块原样传回,并让对话只追加、不改写:
system提示词、tools或更早的消息改过之后,再回放之前的思考块可能返回 400。 - Computer use 改用
computer_toolset_20260801。 在 Claude API 与 Google Cloud 上,旧的computer_20251124工具会被拒绝。 - advisor 搭配变少。 第五项改动收窄了 beta 阶段的 advisor 工具可用的顾问模型,具体搭配见 Anthropic 的页面。
- 工具调用之间的文字改放进
thinking块。 超过一两句的说明会以进度更新形式的thinking块返回,在默认的display: "omitted"下是空的。请求不会失败,但把这些说明流式展示给用户的界面,会在工具调用之间没有动静;迁移指南写了怎么拿回这些文字。 - 思考强度重新校准。 同一档产生的思考量与 Claude Sonnet 5 不同。Anthropic 建议:既不是 Agent 类、也对延迟不敏感的任务从
high起步,范围明确的 Agent 编码从medium起步,对话类从medium或low起步。 - 拒答类别更多。 拒答以 HTTP 200 加
stop_reason: "refusal"返回,stop_details会注明类别:cyber、bio、frontier_llm、reasoning_extraction或general_harms。在 Router One 上,请在自己的代码里换一个模型重试:服务端的fallbacks参数会在请求到达模型之前被 400 拒绝。
分词器与 Claude Sonnet 5 相同,同样的文本得到同样的 token 数,所以两者的每 token 单价可以直接对比。Router One 对 Claude Opus 5.5 做的请求兼容处理(见迁移到 Claude Opus 5.5)不适用于 Claude Sonnet 5.5:请按上面 Anthropic 的规则写它的请求,并检查 stop_reason 和内容块类型,不要默认回复一定是某种形态。
国内怎么用
中国大陆可直连 api.router.one,无需 VPN,Key 和 base URL 与海外完全一致,Claude Code 也一样。充值可用支付宝或银行卡在同一个托管收银台完成,也支持 6 条链上的 USDT/USDC(Tron、BSC、以太坊、Polygon、Base、Arbitrum),无需美国信用卡。Claude Code 的环境变量怎么设,见 Claude Code 国内使用;一步步的配置教程见 Claude Code 配置指南。
常见问题
Router One 上 Claude Sonnet 5.5 的模型 ID 是什么? 目录 id 是 anthropic/claude-sonnet-5.5;网关也接受 Anthropic 官方 id claude-sonnet-5-5,指向同一个模型。在 Claude Code 里请用 claude-sonnet-5-5:遇到不认识的 id,Claude Code 会按 200K 窗口处理。2026-09-30 的套餐接口里没有档位列出这个模型,所以两种 id 都按 token 从钱包扣费。
Claude Sonnet 5.5 是哪天发布的?Router One 从哪天起能调用? Anthropic 于 2026 年 9 月 28 日发布了它。Router One 自 2026-09-29 起上架,目录 id 是 anthropic/claude-sonnet-5.5,网关同时接受 claude-sonnet-5-5;2026-09-30 的套餐接口里没有档位列出它,所以调用按 token 从钱包扣费。
经 Router One 调用 Claude Sonnet 5.5 多少钱? 按 token 计费,单价以 Claude Sonnet 5.5 模型页公示的输入与输出单价为准:整个窗口只有一条价格线,思考按输出 token 计费。对比页会实时渲染它与 Claude Sonnet 5、Claude Opus 5.5 之间的价差。2026-09-30 的套餐接口里没有档位列出它,所以不论是否持有套餐,每次调用都从钱包扣费。
Claude Sonnet 5.5 在 Router One 订阅套餐里吗? 不在。2026-09-30 的套餐接口里 Pro、Max、Ultra 都没有档位列出它,所以不论用哪个套餐,它的调用都按 token 从钱包扣费。Claude Sonnet 5 仍在三个套餐的「中级模型」档;实时的套餐模型列表见价格页。
升级 Claude Code 之后,套餐用户的 Sonnet 请求为什么改从钱包扣费? Claude Code 2.1.284 及以后把 sonnet 别名指向 Claude Sonnet 5.5,发出 claude-sonnet-5-5,而它不在任何套餐档位,所以 /model sonnet、定义为 model: sonnet 的子 agent、/statusline 以及 opusplan 的执行阶段都按 token 从钱包扣费。设置 ANTHROPIC_DEFAULT_SONNET_MODEL=claude-sonnet-5 可以让这些请求继续消耗套餐额度;ANTHROPIC_DEFAULT_HAIKU_MODEL=claude-haiku-4-5 可选,用于后台任务。
Sonnet 5 的代码能直接用在 Sonnet 5.5 上吗? 在 Router One 上 Key、base URL 和端点都不变,只需换 model 字符串;但按 Anthropic 迁移指南(2026-09-30 核对),Sonnet 5 的代码可能仍要改:关闭前置思考改用 between_tools,不再用 disabled;强制 tool_choice(any 或 tool)改为 auto;对话只追加、不改写,thinking 块原样传回;computer use 改用新的工具集。换过去之后的调用从钱包扣费,因为 Claude Sonnet 5.5 不在任何套餐档位。
Claude Sonnet 5.5 能关闭思考吗? 只能关掉前置思考。按 Anthropic 文档,API 上最低一档是 between_tools 类型,在 high 及以下思考强度可用,而 disabled 类型会返回 400;在 Claude Code 里,这个模型的思考无法关闭。思考 token 按输出计费、从钱包扣,所以降低思考强度才是控制成本的办法。
Codex CLI 或 Responses API 能调用 Claude Sonnet 5.5 吗? 不能。Router One 在 /v1/messages 与 /v1/chat/completions 上提供 Claude 系列;Claude id 发到 /v1/responses 会得到 400,提示该模型必须通过 /v1/messages 或 /v1/chat/completions 调用。Codex CLI 只支持 Responses 协议,所以让它继续用 /v1/responses 上提供的 id,比如 GPT 系列。
经 Router One 调用 Claude Sonnet 5.5 能用满 1M 上下文吗? 目录给它列的是 1,048,576 token,整个窗口只有一条价格线,所以长请求和短请求按同样的公示单价从钱包扣费。Claude Code 给窗口留多少预算由客户端决定:它的 2.1.285 更新日志写明,通过自定义 ANTHROPIC_BASE_URL 接入的会话,会对有 1M 窗口的模型(含 Sonnet 5 及以后)使用 1M 窗口。
下一步
- 打开 Claude Sonnet 5.5 模型页,查看实时单价和端点列表。
- 与 Claude Sonnet 5 或 Claude Opus 5.5 对比。
- Claude Opus 5.5 的接入方法,见 Claude Opus 5.5 API 接入指南。
- 配置 Claude Code:Claude Code 国内使用与 Claude Code 配置指南。
- 各套餐覆盖哪些模型,见价格页。
- 本月目录的其他变化,见 2026 年 9 月新模型指南。