Anthropic 于 2026 年 10 月 7 日发布的 Claude Haiku 5.5 已在 Router One 目录上架,目录 id 是 anthropic/claude-haiku-5.5(2026-10-10 上架);网关同时接受 Anthropic 官方 id claude-haiku-5-5。国内开发者不需要海外账号、不需要 VPN:用 Router One 的 Key 向 https://api.router.one/v1/messages 发 "model": "claude-haiku-5-5",或者把 OpenAI 兼容客户端的 base URL 换成 https://api.router.one/v1,请求就会像目录里其他模型一样被路由、计费并记入日志。截至 2026-10-10 的套餐接口,Pro、Max、Ultra 都没有档位列出它,所以每次调用都按 token 从钱包扣费;实时单价看 Claude Haiku 5.5 模型页。
本文依次讲清:目录对这个 id 公开了什么,Anthropic 怎么定位它,Claude Haiku 5.5、Claude Haiku 4.5、Claude Sonnet 5.5 与 Gemini 3.5 Flash Lite 之间怎么选,费用和套餐怎么算,Claude Code 2.1.293 改了什么,两个端点上的第一个请求怎么发,以及从 Claude Haiku 4.5 迁过来要改哪些代码。文中的目录与套餐信息都注明了观察日期,发起新请求前以实时目录为准。
Claude Haiku 5.5 速览
| 项目 | 目录所列(2026-10-10) |
|---|---|
| 目录 id | anthropic/claude-haiku-5.5,2026-10-10 上架 |
| 短 id(别名) | claude-haiku-5-5,即 Anthropic 官方模型 id |
| 上下文窗口 | 1,048,576 token |
| 输入 / 输出 | 文本、图像输入,文本输出 |
| 能力标签 | chat、streaming、tool calling、vision |
| 价格线 | 两条,以 100,000 个提示 token 为界,两条都列在模型页 |
| 端点 | POST /v1/messages(Anthropic 原生,推荐)与 POST /v1/chat/completions |
| 不在此端点服务 | POST /v1/responses |
| 渠道 | 只在默认渠道提供,没有 aws/、vertex/ 或 azure/ 版本 |
| 套餐 | Pro、Max、Ultra 都没有档位列出(2026-10-10 套餐接口),按钱包计费 |
Anthropic 官方的 Claude Haiku 5.5 概览页(2026-10-10 核对)给出的是 Anthropic 自己的规格:发布日期为 2026 年 10 月 7 日,上下文 1M token,支持文本与图像输入,同步 Messages API 下最多输出 128K token,可靠知识截止 2026 年 6 月,官方称它 "built for high-volume, latency-sensitive work such as classification, routing, extraction, and subagent tasks"(面向分类、路由、信息抽取和子 agent 任务这类调用量大、对延迟敏感的工作)。自适应思考默认开启,思考深度由 output_config.effort 控制,可取 low、medium、high、xhigh 与 max,API 默认 medium(effort 文档);在 high 及以下思考强度,仍可用 thinking: {"type": "disabled"} 关闭思考。以上是厂商的说法;Router One 负责的是目录条目本身,以及网关如何路由和计费。
选 Claude Haiku 5.5、Haiku 4.5、Sonnet 5.5 还是 Gemini 3.5 Flash Lite?
按 Anthropic 的发布公告(2026 年 10 月 7 日;2026-10-10 核对),Claude Haiku 5.5 "is designed for high-volume, cost-sensitive tasks"(面向调用量大、对成本敏感的任务),能稳定处理摘要、上下文压缩、数据库查询和分类请求这类快速、重复的工作,并且 "pairs well with Opus 5.5 and Sonnet 5.5 as a subagent on coding work"(在编码工作中适合给 Opus 5.5 和 Sonnet 5.5 当子 agent)。同一页也划了边界:在复杂的 Agent 编码任务上,"Sonnet 5.5 and Opus 5.5 remain better choices"(Sonnet 5.5 与 Opus 5.5 仍是更好的选择),Haiku 5.5 最适合范围更窄的任务,比如上下文压缩、摘要或子 agent 工作。Anthropic 公布的基准分数:Terminal-Bench 4.0 上 Claude Haiku 5.5 为 39.2%(Claude Haiku 4.5 为 0.0%),OSWorld 2.1 离线子集上为 72.4%(Claude Haiku 4.5 为 15.7%)。这些是 Anthropic 的结果,不是 Router One 的测量;把一类任务迁过去之前,先用你自己的提示词跑一遍。
Router One 这一侧,选择时还要看三点:
- 套餐额度还是钱包。 截至 2026-10-10 的套餐接口,Claude Haiku 4.5 与 Gemini 3.5 Flash Lite 都在 Pro、Max、Ultra 的「普通模型」档,用套餐时请求消耗套餐额度;Claude Haiku 5.5 与 Claude Sonnet 5.5 都不在任何套餐档位,调用从钱包扣费。Anthropic 已把 Claude Haiku 4.5 标为 legacy(旧版)模型,写明它 "still available"(仍可使用);其模型弃用页(2026-10-10 核对)写明它的退役时间不早于 2026 年 10 月 15 日,并且公开发布的模型退役前至少提前 60 天通知。
- 公示单价与 token 数。 Router One 为每个模型单独公示单价,Claude Haiku 5.5 的单价分两条价格线,以 100,000 个提示 token 为界。按 Anthropic 的 What's new 页(2026-10-10 核对),同样的文本在 Claude Haiku 5.5 上比在 Claude Haiku 4.5 上约多计 30% 的 token,此前各轮的 thinking 块也会留在上下文里计入输入,所以要比较整个任务的成本,不能只比每 token 单价。下面的对比页会渲染实时数字。
- 中途换模型。 按 Anthropic 迁移指南(2026-10-10 核对),Claude Haiku 5.5 能读取 Claude Haiku 4.5、Claude Sonnet 5、Claude Opus 4.8 及更早模型的 thinking 块,所以对话从这些模型换到 Haiku 5.5 时,推理得以延续;它读不了 Claude Opus 5、Claude Opus 5.5、Claude Sonnet 5.5 以及任何 Claude Fable 模型的 thinking 块,API 会直接丢弃、不报错。反过来,在 Claude API 与 Google Cloud 上,Claude Sonnet 5.5 与 Claude Opus 5.5 能读取 Claude Haiku 5.5 写出的 thinking 块。thinking 块还与对话绑定,所以请在任务边界换模型,不要指望推理一定能接上。
三个对比页用实时目录把规格和单价并排渲染出来:
- Claude Haiku 5.5 vs Claude Haiku 4.5——代际升级,以及钱包计费与「普通模型」套餐额度怎么取舍。
- Claude Haiku 5.5 vs Gemini 3.5 Flash Lite——跨厂商怎么选;Router One 只在
/v1/chat/completions上提供 Gemini 3.5 Flash Lite,所以 Claude Code 只能用 Claude 这一侧;截至 2026-10-10 的套餐接口,Gemini 3.5 Flash Lite 在「普通模型」档,Claude Haiku 5.5 按钱包计费。 - Claude Haiku 5.5 vs Claude Sonnet 5.5——同一类任务用 Haiku 还是 Sonnet;截至 2026-10-10 的套餐接口,两者都不在任何套餐档位、按钱包计费。
费用怎么算
Claude Haiku 5.5 按两条价格线计费。按 Anthropic 的价格文档(2026-10-10 核对),提示超过 100,000 个 token 的请求,输入和输出都按较高的那条价格计,而且每个请求单独计价。Router One 目录按同一个 100,000 token 分界列出自己的两条公示单价,模型页上两条都有。
自适应思考默认开启,由模型按思考强度决定想多少。思考 token 按输出 token 计费(价格事实页);响应里不返回思考文本时也照样计费,而这个模型默认就是 display: "omitted",不返回思考文本(Anthropic 思考文档,2026-10-10 核对)。所以思考强度既是质量旋钮,也是成本旋钮。API 默认 medium;按 Anthropic 的 effort 文档(2026-10-10 核对),建议大多数工作(包括 Agent 编码)从 medium 起步,对话、简短的工具任务和调用量大的简单请求用 low。先按任务比较几档,再定默认值。
本文不印每 token 单价,因为它会过时。两条价格线的实时单价看 Claude Haiku 5.5 模型页,上面的对比页会把它与 Claude Haiku 4.5、Gemini 3.5 Flash Lite、Claude Sonnet 5.5 并排渲染。
订阅套餐覆盖 Claude Haiku 5.5 吗?
不覆盖。截至 2026-10-10 的套餐接口,Pro、Max、Ultra 的任何档位都没有列出 claude-haiku-5-5,所以不论是否持有套餐,Claude Haiku 5.5 的调用都按 token 从钱包余额扣费,单价以模型页公示为准。Claude Haiku 4.5 仍在三个套餐的「普通模型」档;截至 2026-10-10 的套餐接口,Gemini 3.5 Flash Lite 也在这一档。套餐的模型列表会调整,实时列表与额度以价格页为准。
影响最大的是 Claude Code。
Claude Code:haiku 别名现在发出 claude-haiku-5-5
按 Claude Code 更新日志,Claude Code 2.1.293(2026 年 10 月 7 日)把 Anthropic API 上的默认 Haiku 模型换成了 Claude Haiku 5.5;按网关协议文档,Claude Code 会把通过 ANTHROPIC_BASE_URL 接入的网关当作 Claude API 对待(两者均为 2026-10-10 核对),所以指向 Router One 的会话,凡是用到 haiku 别名的地方,发出的都是 claude-haiku-5-5。
2026-10-10 的 npm dist-tags 与原生安装器的通道指针显示:latest 是 2.1.296,stable 是 2.1.287。按模型配置文档(2026-10-10 核对),早于 2.1.293 的版本把 haiku 解析到 Claude Haiku 4.5,所以当天 stable 通道上的 Claude Code 仍是如此;文档也写明 "Use v2.1.293 or later with Haiku 5.5"(使用 Haiku 5.5 请用 v2.1.293 或更高版本)。运行 claude --version 可以确认自己用的是哪个版本。
可选的 Haiku 这一行写进 shell 配置文件;如果配置是一键安装脚本写的,就写进 ~/.claude/settings.json 的 env 块——安装脚本只设置 ANTHROPIC_BASE_URL 与 ANTHROPIC_AUTH_TOKEN,不指定模型:
export ANTHROPIC_DEFAULT_HAIKU_MODEL=claude-haiku-4-5
这一行对所有人都是可选的,不论用套餐还是钱包。按 Claude Code 2.1.296 的更新日志、模型配置与子 agent 文档(2026-10-10 核对),2.1.293 起 haiku 别名解析到 Claude Haiku 5.5(claude-haiku-5-5);截至 2026-10-10 的模型目录,Router One 已列出它,但 2026-10-10 的套餐接口里没有档位列出它。不加这一行时,/model haiku、定义为 model: haiku 的子 agent 和内置的 claude-code-guide 子 agent(子 agent 文档写明它用 Haiku)都按 token 从钱包扣费;加上这一行,它们改用 Claude Haiku 4.5(三个套餐的「普通模型」档)。这一行还决定后台任务用哪个模型:按网关协议文档(2026-10-10 核对),像 Router One 的配置这样用 ANTHROPIC_AUTH_TOKEN 认证的网关会话,后台任务跟随主模型,除非 ANTHROPIC_DEFAULT_HAIKU_MODEL 另行指定。其他别名的固定——所有人都加的 Fable 这一行,以及套餐用户的 Sonnet 与 Opus 固定——见 Claude Code 配置指南与 Claude Code 国内使用。
要把 Claude Haiku 5.5 当主模型用,请用 Anthropic 官方 id,不要用目录 id:模型配置文档(2026-10-10 核对)给出的 id 是 claude-haiku-5-5——会话里运行 /model claude-haiku-5-5,或在 shell 里用 claude --model claude-haiku-5-5 启动;通过自定义 ANTHROPIC_BASE_URL 接入时,Claude Code 会给它认得的模型使用与 Anthropic API 上相同的上下文窗口,Haiku 5.5 就是 1M,默认在约 967K token 时压缩。按同一文档,Claude Code 默认以 medium 思考强度运行 Haiku 5.5,而且不能关闭它的思考,MAX_THINKING_TOKENS=0 对它不起作用;文档还写明,提示超过 100K token 的 Haiku 5.5 请求,每 token 的费用更高。会话上下文一旦超过 100,000 token,在压缩之前,每个请求的提示都在这条分界之上;两条价格线见模型页。
发出第一个请求
- 创建 Key。 控制台 → API 密钥 → 创建密钥,Key 形如
sk-...。试用阶段给这把 Key 设一个maxSpend消费上限:花费不会超过这个上限,其他 Key 照常可用(按 Key 成本追踪)。 - 保证钱包有余额。 不论是否持有套餐,Claude Haiku 5.5 的调用都从钱包扣费;充值在控制台 → 充值。
- 按客户端选 base URL。 Anthropic 原生 SDK 和工具填
https://api.router.one(SDK 的base_url,或ANTHROPIC_BASE_URL),请求发往它下面的/v1/messages;OpenAI 兼容 SDK 填https://api.router.one/v1。 - 调用模型。 下面的示例都用
claude-haiku-5-5;直接发 HTTP 请求时,目录 idanthropic/claude-haiku-5.5同样可用。
Messages API,流式输出,思考强度设为 low:API 默认为 medium,而按 Anthropic 的 effort 文档(2026-10-10 核对),对话、简短的工具任务和调用量大的简单请求适合用 low,下面这种分类请求就是一例:
curl https://api.router.one/v1/messages \
-H "x-api-key: sk-your-api-key" \
-H "anthropic-version: 2023-06-01" \
-H "content-type: application/json" \
-d '{
"model": "claude-haiku-5-5",
"max_tokens": 16000,
"stream": true,
"output_config": {"effort": "low"},
"messages": [{"role": "user", "content": "把这条工单归类为账单、故障或使用咨询,并用一句话说明理由:每次切换标签页,应用都会让我重新登录。"}]
}'
用 Anthropic Python SDK 调用(请用新版 SDK:pip install -U anthropic),只需要改 base_url 和 Key。响应可能以一个或多个 thinking 块开头,所以要按块的类型读取内容,不要按位置取:
import anthropic
client = anthropic.Anthropic(
base_url="https://api.router.one",
api_key="sk-your-api-key",
)
with client.messages.stream(
model="claude-haiku-5-5",
max_tokens=16000,
output_config={"effort": "low"},
messages=[{"role": "user", "content": "把这条工单归类为账单、故障或使用咨询,并用一句话说明理由:每次切换标签页,应用都会让我重新登录。"}],
) as stream:
message = stream.get_final_message()
for block in message.content:
if block.type == "text":
print(block.text)
print(message.stop_reason, message.usage)
Chat Completions,给 OpenAI 兼容客户端用,同样显式设置 max_tokens 并开启流式:
curl https://api.router.one/v1/chat/completions \
-H "Authorization: Bearer sk-your-api-key" \
-H "Content-Type: application/json" \
-d '{
"model": "claude-haiku-5-5",
"max_tokens": 16000,
"stream": true,
"messages": [{"role": "user", "content": "把这条工单归类为账单、故障或使用咨询,并用一句话说明理由:每次切换标签页,应用都会让我重新登录。"}]
}'
两个端点通用的几条规则:
- 每个请求都显式设置
max_tokens。 思考和正文共用这个上限(Anthropic 迁移指南,2026-10-10 核对),不要依赖默认值,要给两者都留出空间:按 Claude Haiku 4.5 调小的上限,可能在thinking块之后、正文之前就停下。Router One 的 Chat Completions 也接受max_completion_tokens作为同一个上限(两者都传时以max_completion_tokens为准)。 - 长任务用流式。
stream: true让输出边生成边返回,不必一直等整段长回答完成(流式输出指南)。 - 保持充足的钱包余额。 请求执行前,网关会按预估额从余额中预留;余额不够时,网关会把
max_tokens调低到余额能覆盖的数值,长回答可能因此被截断。余额连这次请求的初始预留都覆盖不了时,网关会在模型运行前返回 HTTP 402。 - 不要传
temperature、top_p、top_k。 按 Anthropic 迁移指南(2026-10-10 核对),在 Claude Haiku 5.5 上,temperature不是 1、top_p不是 0.99、带任何top_k,或同时带temperature与top_p,都会返回 400;三者都去掉,改用提示词引导。 - 让
messages以 user 轮结尾。 按同一指南,以 assistant 预填作为最后一轮的请求在 Claude Haiku 5.5 上会返回 400,关闭思考也一样:用来规定格式的预填,改用结构化输出(分类任务可以用带 enum 字段的工具);用来省掉开场白的预填,改为在 system 提示词里要求直接作答。 - 文件直接内联。 Router One 不提供 Files API:图片以 base64 内容块传入,PDF 请在
/v1/messages上以 base64document块传入,不要用文件引用。
端点怎么选。 调用 Claude Haiku 5.5 推荐走 /v1/messages:output_config.effort、带 display 选项的 thinking 以及 anthropic-beta 请求头都原样透传,工具循环里要传回给模型的 thinking 块也走这个端点。/v1/chat/completions 能用于普通对话和工具调用,但不转发 anthropic-beta 请求头,也不会跨轮回放思考块,所以多轮工具循环能跑通,却没有推理的连续性;要设置思考强度,请在 /v1/messages 上用 output_config.effort。按 Anthropic 迁移指南(2026-10-10 核对),Claude Haiku 5.5 接受强制的 tool_choice(any 或指定某个工具),但这时响应直接从工具调用开始,没有 thinking 块;想让模型先思考再调用工具,就让 tool_choice 保持 auto,并在提示词里写明什么时候该用这个工具。要 JSON 输出,请用 /v1/messages 加 output_config.format,或者用 strict 工具(见 Anthropic 结构化输出文档);Chat Completions 的 response_format 不是从 Claude id 拿到 JSON 的可靠办法。另外,Router One 的 /v1/messages/count_tokens 返回的是本地估算,不是 Anthropic 的计数——实际计费的数字以每次响应里的 usage 为准。
- 看 Trace。 控制台 → 日志里每次调用都带模型、输入输出 token、费用、延迟和状态(每请求可观测)。参数错误导致的 400 不会被重试,也不会换到别的模型:失败的 Claude Haiku 5.5 请求绝不会被 Claude Haiku 4.5 或其他模型悄悄代答。
与 Claude Haiku 4.5 相比有哪些变化
Anthropic 的 What's new 页列出了影响现有 Claude Haiku 4.5 代码的不兼容改动和行为变化,迁移指南把它们整理成了检查清单(两者均为 2026-10-10 核对)。要改的不只是 model 字符串。按 Anthropic 对其 API 的说明,简要来说:
- 手动思考预算返回 400。 在 Claude Haiku 5.5 上,
thinking: {"type": "enabled", "budget_tokens": N}会被拒绝。不传thinking,或改发{"type": "adaptive"},思考深度用output_config.effort控制:原来在 Claude Haiku 4.5 上不开思考、或只给很小预算的请求,选一个较低的思考强度。 - 思考默认开启,思考文本默认省略。 即使请求里没提思考,响应也可能以一个或多个
thinking块开头,所以要按type选取内容块。这些块默认返回空的thinking字段,要拿到思考摘要,需发送thinking: {"type": "adaptive", "display": "summarized"};Claude Haiku 4.5 则默认返回摘要。在high及以下思考强度仍可用{"type": "disabled"}关闭思考(xhigh、max下会返回 400),但 Anthropic 认为调思考强度是更好的办法。 - 采样参数与预填返回 400。 去掉
temperature、top_p和top_k(取值规则见上文),并让messages以 user 轮结尾:即使关闭思考,assistant 预填也会被拒绝。 - 强制工具调用会被接受,但没有思考。
tool_choice设为any或指定某个工具都会被接受,但响应直接从工具调用开始,不带thinking块。 - 同样的文本计出更多 token。 Claude Haiku 5.5 使用 Claude 4.7 及以后模型的新分词器:同样的文本比在 Claude Haiku 4.5 上约多 30% 的 token,具体取决于内容;大图也可能计出更多视觉 token。请重新核算提示词、
max_tokens上限与成本估算,不要沿用 Haiku 4.5 的数字。 - 此前的思考留在上下文里。 此前所有 assistant 轮次的 thinking 块都会留在上下文中、计入输入 token,而 Claude Haiku 4.5 只保留最近一轮的,所以多轮对话的输入会更多。让对话只追加、不改写,并把 thinking 块原样传回:
system提示词、tools或更早的消息改过之后,再回放之前的 thinking 块可能返回 400。 - Computer use 改用
computer_toolset_20260801。 在 Claude API 与 Google Cloud 上,声明computer_20250124的请求会返回 400。 - 新增拒答。 拒答以
stop_reason: "refusal"返回,stop_details会注明类别:cyber、frontier_llm、bio或general_harms;Claude Haiku 5.5 没有服务端回退。在 Router One 上,请在自己的代码里换一个模型重试:服务端的fallbacks参数会在请求到达模型之前被 400 拒绝。
在 Router One 上,Key、base URL 和端点都不变,切换本身只是换 model 字符串;但为 Claude Haiku 4.5 写的代码可能要先做完上面的改动:请按 Anthropic 的规则写 Claude Haiku 5.5 的请求,并检查 stop_reason 和内容块类型,不要默认回复一定是某种形态。
国内怎么用
中国大陆可直连 api.router.one,无需 VPN,Key 和 base URL 与海外完全一致,Claude Code 也一样。充值可用支付宝或银行卡在同一个托管收银台完成,也支持 6 条链上的 USDT/USDC(Tron、BSC、以太坊、Polygon、Base、Arbitrum),无需美国信用卡。Claude Code 的环境变量怎么设,见 Claude Code 国内使用;一步步的配置教程见 Claude Code 配置指南。
常见问题
Router One 上 Claude Haiku 5.5 的模型 ID 是什么? 目录 id 是 anthropic/claude-haiku-5.5;网关也接受 Anthropic 官方 id claude-haiku-5-5,在 /v1/messages 与 /v1/chat/completions 上指向同一个模型。在 Claude Code 里请用 claude-haiku-5-5:按 Claude Code 模型配置文档(2026-10-10 核对),这就是该模型的 id,2.1.293 起 haiku 别名发出的也是它。截至 2026-10-10 的套餐接口,没有档位列出这个模型,所以两种 id 都按 token 从钱包扣费。
Claude Haiku 5.5 是哪天发布的?Router One 从哪天起能调用? Anthropic 于 2026 年 10 月 7 日发布了它。Router One 于 2026-10-10 上架,目录 id 是 anthropic/claude-haiku-5.5,网关同时接受 claude-haiku-5-5;截至 2026-10-10 的套餐接口,没有档位列出它,所以调用按 token 从钱包扣费。
经 Router One 调用 Claude Haiku 5.5 多少钱? 按 token 计费,单价以 Claude Haiku 5.5 模型页公示的输入与输出单价为准,模型页列出两条价格线:按 Anthropic 价格文档(2026-10-10 核对),提示超过 100,000 个 token 的请求按较高的那条计价,Router One 目录按同一分界列出自己的两条公示单价。思考按输出 token 计费。对比页会实时渲染它与 Claude Haiku 4.5、Gemini 3.5 Flash Lite、Claude Sonnet 5.5 的单价。截至 2026-10-10 的套餐接口,没有档位列出它,所以不论是否持有套餐,每次调用都从钱包扣费。
Claude Haiku 5.5 在 Router One 订阅套餐里吗? 不在。截至 2026-10-10 的套餐接口,Pro、Max、Ultra 都没有档位列出它,所以不论用哪个套餐,它的调用都按 token 从钱包扣费。Claude Haiku 4.5 仍在三个套餐的「普通模型」档;实时的套餐模型列表见价格页。
升级 Claude Code 之后,haiku 别名的请求为什么改从钱包扣费? 按 Claude Code 2.1.296 的更新日志与模型配置文档(2026-10-10 核对),2.1.293 及以后把 haiku 别名指向 Claude Haiku 5.5,发出 claude-haiku-5-5,而截至 2026-10-10 的套餐接口,没有档位列出它,所以 /model haiku、定义为 model: haiku 的子 agent 和内置的 claude-code-guide 子 agent 都按 token 从钱包扣费。ANTHROPIC_DEFAULT_HAIKU_MODEL=claude-haiku-4-5 这一行对所有人都是可选的:设置后,这些请求和后台任务都改用 Claude Haiku 4.5,它在三个套餐的「普通模型」档。
为 Haiku 4.5 写的代码能直接用在 Haiku 5.5 上吗? 不一定。在 Router One 上 Key、base URL 和端点都不变,但按 Anthropic 迁移指南(2026-10-10 核对),为 Haiku 4.5 写的代码可能要先改:把 budget_tokens 思考预算换成自适应思考加思考强度,去掉 temperature、top_p 与 top_k,用 user 轮代替 assistant 预填作为结尾,按 type 读取内容块,并重新核算 token,因为同样的文本约多计 30% 的 token。换过去之后的调用从钱包扣费,因为截至 2026-10-10 的套餐接口,没有档位列出 Claude Haiku 5.5。
选 Claude Haiku 5.5 还是 Gemini 3.5 Flash Lite? 按 2026-10-10 的模型目录,两者都接受文本与图像输入,上下文窗口都是 1,048,576 token;在 Router One 上的区别有两点。端点:Claude Haiku 5.5 在 /v1/messages 与 /v1/chat/completions 上提供,Gemini 3.5 Flash Lite 只在 /v1/chat/completions 上提供,所以 Claude Code 只能用 Claude Haiku 5.5。套餐:截至 2026-10-10 的套餐接口,Gemini 3.5 Flash Lite 在 Pro、Max、Ultra 的「普通模型」档,Claude Haiku 5.5 不在任何套餐档位、按钱包计费。两者的请求规则以各自厂商的文档为准,对比页并排渲染规格与实时单价。
Codex CLI 或 Responses API 能调用 Claude Haiku 5.5 吗? 不能。Router One 在 /v1/messages 与 /v1/chat/completions 上提供 Claude 系列,不在 /v1/responses 上提供;Codex CLI 只支持 Responses 协议,所以让它继续用 /v1/responses 上提供的 id,比如 GPT 系列,Claude Haiku 5.5 则从 Messages 或 Chat Completions 客户端调用。
Claude Haiku 5.5 能关闭思考吗? 在 API 上可以,但限于 high 及以下思考强度:按 Anthropic 的思考与 effort 文档(2026-10-10 核对),Claude Haiku 5.5 在 high 及以下接受 disabled 类型,在 xhigh 或 max 思考强度下发送 disabled 会返回 400,Claude Sonnet 5.5 用的 between_tools 类型在 Claude Haiku 5.5 上同样返回 400;Anthropic 认为,要拿质量换速度和成本,降低思考强度是更好的办法。在 Claude Code 里,按其模型配置文档(Claude Code 2.1.296,2026-10-10 核对),这个模型的思考无法关闭。思考 token 按输出计费、从钱包扣,所以思考强度才是控制成本的办法。
下一步
- 打开 Claude Haiku 5.5 模型页,查看实时单价和端点列表。
- 与 Claude Haiku 4.5、Gemini 3.5 Flash Lite 或 Claude Sonnet 5.5 对比。
- Claude Sonnet 5.5 的接入方法,见 Claude Sonnet 5.5 API 接入指南。
- 配置 Claude Code:Claude Code 国内使用与 Claude Code 配置指南。
- 各套餐覆盖哪些模型,见价格页。
- 本月目录的其他变化,见 2026 年 10 月新模型指南。