> https://router.one/zh/blog/claude-haiku-5-5-api-guide 的 Markdown 镜像，供 AI 助手与爬虫使用。Router One 是 OpenAI 兼容的统一 LLM API 网关。
> 发布：2026-10-10 · 作者：Router One Team

# Claude Haiku 5.5 API 接入指南：国内调用、计费与 Claude Code

_Claude Haiku 5.5 国内直连：claude-haiku-5-5 模型 ID、1M 上下文、以 10 万提示 token 为界的两档单价，不在任何套餐档位、按钱包计费，附 Claude Code 别名说明。_

Anthropic 于 2026 年 10 月 7 日发布的 Claude Haiku 5.5 已在 Router One 目录上架，目录 id 是 `anthropic/claude-haiku-5.5`（2026-10-10 上架）；网关同时接受 Anthropic 官方 id `claude-haiku-5-5`。国内开发者不需要海外账号、不需要 VPN：用 Router One 的 Key 向 `https://api.router.one/v1/messages` 发 `"model": "claude-haiku-5-5"`，或者把 OpenAI 兼容客户端的 base URL 换成 `https://api.router.one/v1`，请求就会像目录里其他模型一样被路由、计费并记入日志。截至 2026-10-10 的套餐接口，Pro、Max、Ultra 都没有档位列出它，所以每次调用都按 token 从钱包扣费；实时单价看 [Claude Haiku 5.5 模型页](https://router.one/zh/models/claude-haiku-5-5)。

本文依次讲清：目录对这个 id 公开了什么，Anthropic 怎么定位它，Claude Haiku 5.5、Claude Haiku 4.5、Claude Sonnet 5.5 与 Gemini 3.5 Flash Lite 之间怎么选，费用和套餐怎么算，Claude Code 2.1.293 改了什么，两个端点上的第一个请求怎么发，以及从 Claude Haiku 4.5 迁过来要改哪些代码。文中的目录与套餐信息都注明了观察日期，发起新请求前以实时目录为准。

## Claude Haiku 5.5 速览

| 项目 | 目录所列（2026-10-10） |
| --- | --- |
| 目录 id | `anthropic/claude-haiku-5.5`，2026-10-10 上架 |
| 短 id（别名） | `claude-haiku-5-5`，即 Anthropic 官方模型 id |
| 上下文窗口 | 1,048,576 token |
| 输入 / 输出 | 文本、图像输入，文本输出 |
| 能力标签 | chat、streaming、tool calling、vision |
| 价格线 | 两条，以 100,000 个提示 token 为界，两条都列在模型页 |
| 端点 | `POST /v1/messages`（Anthropic 原生，推荐）与 `POST /v1/chat/completions` |
| 不在此端点服务 | `POST /v1/responses` |
| 渠道 | 只在默认渠道提供，没有 `aws/`、`vertex/` 或 `azure/` 版本 |
| 套餐 | Pro、Max、Ultra 都没有档位列出（2026-10-10 套餐接口），按钱包计费 |

Anthropic 官方的 [Claude Haiku 5.5 概览页](https://platform.claude.com/docs/en/models/haiku-5-5/overview)（2026-10-10 核对）给出的是 Anthropic 自己的规格：发布日期为 2026 年 10 月 7 日，上下文 1M token，支持文本与图像输入，同步 Messages API 下最多输出 128K token，可靠知识截止 2026 年 6 月，官方称它 "built for high-volume, latency-sensitive work such as classification, routing, extraction, and subagent tasks"（面向分类、路由、信息抽取和子 agent 任务这类调用量大、对延迟敏感的工作）。自适应思考默认开启，思考深度由 `output_config.effort` 控制，可取 `low`、`medium`、`high`、`xhigh` 与 `max`，API 默认 `medium`（[effort 文档](https://platform.claude.com/docs/en/build-with-claude/effort)）；在 `high` 及以下思考强度，仍可用 `thinking: {"type": "disabled"}` 关闭思考。以上是厂商的说法；Router One 负责的是目录条目本身，以及网关如何路由和计费。

## 选 Claude Haiku 5.5、Haiku 4.5、Sonnet 5.5 还是 Gemini 3.5 Flash Lite？

按 Anthropic 的[发布公告](https://www.anthropic.com/claude-haiku-5-5)（2026 年 10 月 7 日；2026-10-10 核对），Claude Haiku 5.5 "is designed for high-volume, cost-sensitive tasks"（面向调用量大、对成本敏感的任务），能稳定处理摘要、上下文压缩、数据库查询和分类请求这类快速、重复的工作，并且 "pairs well with Opus 5.5 and Sonnet 5.5 as a subagent on coding work"（在编码工作中适合给 Opus 5.5 和 Sonnet 5.5 当子 agent）。同一页也划了边界：在复杂的 Agent 编码任务上，"Sonnet 5.5 and Opus 5.5 remain better choices"（Sonnet 5.5 与 Opus 5.5 仍是更好的选择），Haiku 5.5 最适合范围更窄的任务，比如上下文压缩、摘要或子 agent 工作。Anthropic 公布的基准分数：Terminal-Bench 4.0 上 Claude Haiku 5.5 为 39.2%（Claude Haiku 4.5 为 0.0%），OSWorld 2.1 离线子集上为 72.4%（Claude Haiku 4.5 为 15.7%）。这些是 Anthropic 的结果，不是 Router One 的测量；把一类任务迁过去之前，先用你自己的提示词跑一遍。

Router One 这一侧，选择时还要看三点：

- **套餐额度还是钱包。** 截至 2026-10-10 的套餐接口，Claude Haiku 4.5 与 Gemini 3.5 Flash Lite 都在 Pro、Max、Ultra 的「普通模型」档，用套餐时请求消耗套餐额度；Claude Haiku 5.5 与 Claude Sonnet 5.5 都不在任何套餐档位，调用从钱包扣费。Anthropic 已把 [Claude Haiku 4.5](https://platform.claude.com/docs/en/models/haiku-4-5/overview) 标为 legacy（旧版）模型，写明它 "still available"（仍可使用）；其[模型弃用页](https://platform.claude.com/docs/en/about-claude/model-deprecations)（2026-10-10 核对）写明它的退役时间不早于 2026 年 10 月 15 日，并且公开发布的模型退役前至少提前 60 天通知。
- **公示单价与 token 数。** Router One 为每个模型单独公示单价，Claude Haiku 5.5 的单价分两条价格线，以 100,000 个提示 token 为界。按 Anthropic 的 What's new 页（2026-10-10 核对），同样的文本在 Claude Haiku 5.5 上比在 Claude Haiku 4.5 上约多计 30% 的 token，此前各轮的 thinking 块也会留在上下文里计入输入，所以要比较整个任务的成本，不能只比每 token 单价。下面的对比页会渲染实时数字。
- **中途换模型。** 按 Anthropic 迁移指南（2026-10-10 核对），Claude Haiku 5.5 能读取 Claude Haiku 4.5、Claude Sonnet 5、Claude Opus 4.8 及更早模型的 thinking 块，所以对话从这些模型换到 Haiku 5.5 时，推理得以延续；它读不了 Claude Opus 5、Claude Opus 5.5、Claude Sonnet 5.5 以及任何 Claude Fable 模型的 thinking 块，API 会直接丢弃、不报错。反过来，在 Claude API 与 Google Cloud 上，Claude Sonnet 5.5 与 Claude Opus 5.5 能读取 Claude Haiku 5.5 写出的 thinking 块。thinking 块还与对话绑定，所以请在任务边界换模型，不要指望推理一定能接上。

三个对比页用实时目录把规格和单价并排渲染出来：

- [Claude Haiku 5.5 vs Claude Haiku 4.5](https://router.one/zh/models/compare/claude-haiku-5-5-vs-claude-haiku-4-5)——代际升级，以及钱包计费与「普通模型」套餐额度怎么取舍。
- [Claude Haiku 5.5 vs Gemini 3.5 Flash Lite](https://router.one/zh/models/compare/claude-haiku-5-5-vs-gemini-3-5-flash-lite)——跨厂商怎么选；Router One 只在 `/v1/chat/completions` 上提供 Gemini 3.5 Flash Lite，所以 Claude Code 只能用 Claude 这一侧；截至 2026-10-10 的套餐接口，Gemini 3.5 Flash Lite 在「普通模型」档，Claude Haiku 5.5 按钱包计费。
- [Claude Haiku 5.5 vs Claude Sonnet 5.5](https://router.one/zh/models/compare/claude-haiku-5-5-vs-claude-sonnet-5-5)——同一类任务用 Haiku 还是 Sonnet；截至 2026-10-10 的套餐接口，两者都不在任何套餐档位、按钱包计费。

## 费用怎么算

Claude Haiku 5.5 按两条价格线计费。按 Anthropic 的[价格文档](https://platform.claude.com/docs/en/about-claude/pricing)（2026-10-10 核对），提示超过 100,000 个 token 的请求，输入和输出都按较高的那条价格计，而且每个请求单独计价。Router One 目录按同一个 100,000 token 分界列出自己的两条公示单价，[模型页](https://router.one/zh/models/claude-haiku-5-5)上两条都有。

自适应思考默认开启，由模型按思考强度决定想多少。思考 token 按输出 token 计费（[价格事实页](https://router.one/zh/facts/pricing.md)）；响应里不返回思考文本时也照样计费，而这个模型默认就是 `display: "omitted"`，不返回思考文本（[Anthropic 思考文档](https://platform.claude.com/docs/en/build-with-claude/thinking)，2026-10-10 核对）。所以思考强度既是质量旋钮，也是成本旋钮。API 默认 `medium`；按 Anthropic 的 [effort 文档](https://platform.claude.com/docs/en/build-with-claude/effort)（2026-10-10 核对），建议大多数工作（包括 Agent 编码）从 `medium` 起步，对话、简短的工具任务和调用量大的简单请求用 `low`。先按任务比较几档，再定默认值。

本文不印每 token 单价，因为它会过时。两条价格线的实时单价看 [Claude Haiku 5.5 模型页](https://router.one/zh/models/claude-haiku-5-5)，上面的对比页会把它与 Claude Haiku 4.5、Gemini 3.5 Flash Lite、Claude Sonnet 5.5 并排渲染。

## 订阅套餐覆盖 Claude Haiku 5.5 吗？

不覆盖。截至 2026-10-10 的套餐接口，Pro、Max、Ultra 的任何档位都没有列出 `claude-haiku-5-5`，所以不论是否持有套餐，Claude Haiku 5.5 的调用都按 token 从钱包余额扣费，单价以模型页公示为准。Claude Haiku 4.5 仍在三个套餐的「普通模型」档；截至 2026-10-10 的套餐接口，Gemini 3.5 Flash Lite 也在这一档。套餐的模型列表会调整，实时列表与额度以[价格页](https://router.one/zh/pricing)为准。

影响最大的是 Claude Code。

## Claude Code：haiku 别名现在发出 claude-haiku-5-5

按 [Claude Code 更新日志](https://code.claude.com/docs/en/changelog)，Claude Code 2.1.293（2026 年 10 月 7 日）把 Anthropic API 上的默认 Haiku 模型换成了 Claude Haiku 5.5；按[网关协议文档](https://code.claude.com/docs/en/llm-gateway-protocol)，Claude Code 会把通过 `ANTHROPIC_BASE_URL` 接入的网关当作 Claude API 对待（两者均为 2026-10-10 核对），所以指向 Router One 的会话，凡是用到 `haiku` 别名的地方，发出的都是 `claude-haiku-5-5`。

2026-10-10 的 npm dist-tags 与原生安装器的通道指针显示：`latest` 是 2.1.296，`stable` 是 2.1.287。按[模型配置文档](https://code.claude.com/docs/en/model-config)（2026-10-10 核对），早于 2.1.293 的版本把 `haiku` 解析到 Claude Haiku 4.5，所以当天 `stable` 通道上的 Claude Code 仍是如此；文档也写明 "Use v2.1.293 or later with Haiku 5.5"（使用 Haiku 5.5 请用 v2.1.293 或更高版本）。运行 `claude --version` 可以确认自己用的是哪个版本。

可选的 Haiku 这一行写进 shell 配置文件；如果配置是一键安装脚本写的，就写进 `~/.claude/settings.json` 的 `env` 块——安装脚本只设置 `ANTHROPIC_BASE_URL` 与 `ANTHROPIC_AUTH_TOKEN`，不指定模型：

```bash
export ANTHROPIC_DEFAULT_HAIKU_MODEL=claude-haiku-4-5
```

这一行对所有人都是可选的，不论用套餐还是钱包。按 Claude Code 2.1.296 的更新日志、模型配置与子 agent 文档（2026-10-10 核对），2.1.293 起 `haiku` 别名解析到 Claude Haiku 5.5（claude-haiku-5-5）；截至 2026-10-10 的模型目录，Router One 已列出它，但 2026-10-10 的套餐接口里没有档位列出它。不加这一行时，`/model haiku`、定义为 `model: haiku` 的子 agent 和内置的 claude-code-guide 子 agent（子 agent 文档写明它用 Haiku）都按 token 从钱包扣费；加上这一行，它们改用 Claude Haiku 4.5（三个套餐的「普通模型」档）。这一行还决定后台任务用哪个模型：按[网关协议文档](https://code.claude.com/docs/en/llm-gateway-protocol)（2026-10-10 核对），像 Router One 的配置这样用 `ANTHROPIC_AUTH_TOKEN` 认证的网关会话，后台任务跟随主模型，除非 `ANTHROPIC_DEFAULT_HAIKU_MODEL` 另行指定。其他别名的固定——所有人都加的 Fable 这一行，以及套餐用户的 Sonnet 与 Opus 固定——见 [Claude Code 配置指南](https://router.one/zh/blog/claude-code-setup-guide)与 [Claude Code 国内使用](https://router.one/zh/claude-code-china)。

要把 Claude Haiku 5.5 当主模型用，请用 Anthropic 官方 id，不要用目录 id：模型配置文档（2026-10-10 核对）给出的 id 是 `claude-haiku-5-5`——会话里运行 `/model claude-haiku-5-5`，或在 shell 里用 `claude --model claude-haiku-5-5` 启动；通过自定义 `ANTHROPIC_BASE_URL` 接入时，Claude Code 会给它认得的模型使用与 Anthropic API 上相同的上下文窗口，Haiku 5.5 就是 1M，默认在约 967K token 时压缩。按同一文档，Claude Code 默认以 `medium` 思考强度运行 Haiku 5.5，而且不能关闭它的思考，`MAX_THINKING_TOKENS=0` 对它不起作用；文档还写明，提示超过 100K token 的 Haiku 5.5 请求，每 token 的费用更高。会话上下文一旦超过 100,000 token，在压缩之前，每个请求的提示都在这条分界之上；两条价格线见[模型页](https://router.one/zh/models/claude-haiku-5-5)。

## 发出第一个请求

1. **创建 Key。** 控制台 → API 密钥 → 创建密钥，Key 形如 `sk-...`。试用阶段给这把 Key 设一个 `maxSpend` 消费上限：花费不会超过这个上限，其他 Key 照常可用（[按 Key 成本追踪](https://router.one/zh/llm-cost-tracking)）。
2. **保证钱包有余额。** 不论是否持有套餐，Claude Haiku 5.5 的调用都从钱包扣费；充值在控制台 → 充值。
3. **按客户端选 base URL。** Anthropic 原生 SDK 和工具填 `https://api.router.one`（SDK 的 `base_url`，或 `ANTHROPIC_BASE_URL`），请求发往它下面的 `/v1/messages`；OpenAI 兼容 SDK 填 `https://api.router.one/v1`。
4. **调用模型。** 下面的示例都用 `claude-haiku-5-5`；直接发 HTTP 请求时，目录 id `anthropic/claude-haiku-5.5` 同样可用。

Messages API，流式输出，思考强度设为 `low`：API 默认为 `medium`，而按 Anthropic 的 effort 文档（2026-10-10 核对），对话、简短的工具任务和调用量大的简单请求适合用 `low`，下面这种分类请求就是一例：

```bash
curl https://api.router.one/v1/messages \
  -H "x-api-key: sk-your-api-key" \
  -H "anthropic-version: 2023-06-01" \
  -H "content-type: application/json" \
  -d '{
    "model": "claude-haiku-5-5",
    "max_tokens": 16000,
    "stream": true,
    "output_config": {"effort": "low"},
    "messages": [{"role": "user", "content": "把这条工单归类为账单、故障或使用咨询，并用一句话说明理由：每次切换标签页，应用都会让我重新登录。"}]
  }'
```

用 Anthropic Python SDK 调用（请用新版 SDK：`pip install -U anthropic`），只需要改 `base_url` 和 Key。响应可能以一个或多个 `thinking` 块开头，所以要按块的类型读取内容，不要按位置取：

```python
import anthropic

client = anthropic.Anthropic(
    base_url="https://api.router.one",
    api_key="sk-your-api-key",
)

with client.messages.stream(
    model="claude-haiku-5-5",
    max_tokens=16000,
    output_config={"effort": "low"},
    messages=[{"role": "user", "content": "把这条工单归类为账单、故障或使用咨询，并用一句话说明理由：每次切换标签页，应用都会让我重新登录。"}],
) as stream:
    message = stream.get_final_message()

for block in message.content:
    if block.type == "text":
        print(block.text)
print(message.stop_reason, message.usage)
```

Chat Completions，给 OpenAI 兼容客户端用，同样显式设置 `max_tokens` 并开启流式：

```bash
curl https://api.router.one/v1/chat/completions \
  -H "Authorization: Bearer sk-your-api-key" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "claude-haiku-5-5",
    "max_tokens": 16000,
    "stream": true,
    "messages": [{"role": "user", "content": "把这条工单归类为账单、故障或使用咨询，并用一句话说明理由：每次切换标签页，应用都会让我重新登录。"}]
  }'
```

两个端点通用的几条规则：

- **每个请求都显式设置 `max_tokens`。** 思考和正文共用这个上限（[Anthropic 迁移指南](https://platform.claude.com/docs/en/models/haiku-5-5/migration-guide)，2026-10-10 核对），不要依赖默认值，要给两者都留出空间：按 Claude Haiku 4.5 调小的上限，可能在 `thinking` 块之后、正文之前就停下。Router One 的 Chat Completions 也接受 `max_completion_tokens` 作为同一个上限（两者都传时以 `max_completion_tokens` 为准）。
- **长任务用流式。** `stream: true` 让输出边生成边返回，不必一直等整段长回答完成（[流式输出指南](https://router.one/zh/llm-streaming)）。
- **保持充足的钱包余额。** 请求执行前，网关会按预估额从余额中预留；余额不够时，网关会把 `max_tokens` 调低到余额能覆盖的数值，长回答可能因此被截断。余额连这次请求的初始预留都覆盖不了时，网关会在模型运行前返回 HTTP 402。
- **不要传 `temperature`、`top_p`、`top_k`。** 按 Anthropic 迁移指南（2026-10-10 核对），在 Claude Haiku 5.5 上，`temperature` 不是 1、`top_p` 不是 0.99、带任何 `top_k`，或同时带 `temperature` 与 `top_p`，都会返回 400；三者都去掉，改用提示词引导。
- **让 `messages` 以 user 轮结尾。** 按同一指南，以 assistant 预填作为最后一轮的请求在 Claude Haiku 5.5 上会返回 400，关闭思考也一样：用来规定格式的预填，改用结构化输出（分类任务可以用带 enum 字段的工具）；用来省掉开场白的预填，改为在 system 提示词里要求直接作答。
- **文件直接内联。** Router One 不提供 Files API：图片以 base64 内容块传入，PDF 请在 `/v1/messages` 上以 base64 `document` 块传入，不要用文件引用。

**端点怎么选。** 调用 Claude Haiku 5.5 推荐走 `/v1/messages`：`output_config.effort`、带 `display` 选项的 `thinking` 以及 `anthropic-beta` 请求头都原样透传，工具循环里要传回给模型的 `thinking` 块也走这个端点。`/v1/chat/completions` 能用于普通对话和工具调用，但不转发 `anthropic-beta` 请求头，也不会跨轮回放思考块，所以多轮工具循环能跑通，却没有推理的连续性；要设置思考强度，请在 `/v1/messages` 上用 `output_config.effort`。按 Anthropic 迁移指南（2026-10-10 核对），Claude Haiku 5.5 接受强制的 `tool_choice`（`any` 或指定某个工具），但这时响应直接从工具调用开始，没有 `thinking` 块；想让模型先思考再调用工具，就让 `tool_choice` 保持 `auto`，并在提示词里写明什么时候该用这个工具。要 JSON 输出，请用 `/v1/messages` 加 `output_config.format`，或者用 strict 工具（见 [Anthropic 结构化输出文档](https://platform.claude.com/docs/en/build-with-claude/structured-outputs)）；Chat Completions 的 `response_format` 不是从 Claude id 拿到 JSON 的可靠办法。另外，Router One 的 `/v1/messages/count_tokens` 返回的是本地估算，不是 Anthropic 的计数——实际计费的数字以每次响应里的 `usage` 为准。

5. **看 Trace。** 控制台 → 日志里每次调用都带模型、输入输出 token、费用、延迟和状态（[每请求可观测](https://router.one/zh/llm-observability)）。参数错误导致的 400 不会被重试，也不会换到别的模型：失败的 Claude Haiku 5.5 请求绝不会被 Claude Haiku 4.5 或其他模型悄悄代答。

## 与 Claude Haiku 4.5 相比有哪些变化

Anthropic 的 [What's new 页](https://platform.claude.com/docs/en/models/haiku-5-5/whats-new-haiku-5-5)列出了影响现有 Claude Haiku 4.5 代码的不兼容改动和行为变化，[迁移指南](https://platform.claude.com/docs/en/models/haiku-5-5/migration-guide)把它们整理成了检查清单（两者均为 2026-10-10 核对）。要改的不只是 model 字符串。按 Anthropic 对其 API 的说明，简要来说：

- **手动思考预算返回 400。** 在 Claude Haiku 5.5 上，`thinking: {"type": "enabled", "budget_tokens": N}` 会被拒绝。不传 `thinking`，或改发 `{"type": "adaptive"}`，思考深度用 `output_config.effort` 控制：原来在 Claude Haiku 4.5 上不开思考、或只给很小预算的请求，选一个较低的思考强度。
- **思考默认开启，思考文本默认省略。** 即使请求里没提思考，响应也可能以一个或多个 `thinking` 块开头，所以要按 `type` 选取内容块。这些块默认返回空的 `thinking` 字段，要拿到思考摘要，需发送 `thinking: {"type": "adaptive", "display": "summarized"}`；Claude Haiku 4.5 则默认返回摘要。在 `high` 及以下思考强度仍可用 `{"type": "disabled"}` 关闭思考（`xhigh`、`max` 下会返回 400），但 Anthropic 认为调思考强度是更好的办法。
- **采样参数与预填返回 400。** 去掉 `temperature`、`top_p` 和 `top_k`（取值规则见上文），并让 `messages` 以 user 轮结尾：即使关闭思考，assistant 预填也会被拒绝。
- **强制工具调用会被接受，但没有思考。** `tool_choice` 设为 `any` 或指定某个工具都会被接受，但响应直接从工具调用开始，不带 `thinking` 块。
- **同样的文本计出更多 token。** Claude Haiku 5.5 使用 Claude 4.7 及以后模型的新分词器：同样的文本比在 Claude Haiku 4.5 上约多 30% 的 token，具体取决于内容；大图也可能计出更多视觉 token。请重新核算提示词、`max_tokens` 上限与成本估算，不要沿用 Haiku 4.5 的数字。
- **此前的思考留在上下文里。** 此前所有 assistant 轮次的 thinking 块都会留在上下文中、计入输入 token，而 Claude Haiku 4.5 只保留最近一轮的，所以多轮对话的输入会更多。让对话只追加、不改写，并把 thinking 块原样传回：`system` 提示词、`tools` 或更早的消息改过之后，再回放之前的 thinking 块可能返回 400。
- **Computer use 改用 `computer_toolset_20260801`。** 在 Claude API 与 Google Cloud 上，声明 `computer_20250124` 的请求会返回 400。
- **新增拒答。** 拒答以 `stop_reason: "refusal"` 返回，`stop_details` 会注明类别：`cyber`、`frontier_llm`、`bio` 或 `general_harms`；Claude Haiku 5.5 没有服务端回退。在 Router One 上，请在自己的代码里换一个模型重试：服务端的 `fallbacks` 参数会在请求到达模型之前被 400 拒绝。

在 Router One 上，Key、base URL 和端点都不变，切换本身只是换 model 字符串；但为 Claude Haiku 4.5 写的代码可能要先做完上面的改动：请按 Anthropic 的规则写 Claude Haiku 5.5 的请求，并检查 `stop_reason` 和内容块类型，不要默认回复一定是某种形态。

## 国内怎么用

中国大陆可直连 `api.router.one`，无需 VPN，Key 和 base URL 与海外完全一致，Claude Code 也一样。充值可用支付宝或银行卡在同一个托管收银台完成，也支持 6 条链上的 USDT/USDC（Tron、BSC、以太坊、Polygon、Base、Arbitrum），无需美国信用卡。Claude Code 的环境变量怎么设，见 [Claude Code 国内使用](https://router.one/zh/claude-code-china)；一步步的配置教程见 [Claude Code 配置指南](https://router.one/zh/blog/claude-code-setup-guide)。

## 常见问题

**Router One 上 Claude Haiku 5.5 的模型 ID 是什么？**
目录 id 是 anthropic/claude-haiku-5.5；网关也接受 Anthropic 官方 id claude-haiku-5-5，在 /v1/messages 与 /v1/chat/completions 上指向同一个模型。在 Claude Code 里请用 claude-haiku-5-5：按 Claude Code 模型配置文档（2026-10-10 核对），这就是该模型的 id，2.1.293 起 haiku 别名发出的也是它。截至 2026-10-10 的套餐接口，没有档位列出这个模型，所以两种 id 都按 token 从钱包扣费。

**Claude Haiku 5.5 是哪天发布的？Router One 从哪天起能调用？**
Anthropic 于 2026 年 10 月 7 日发布了它。Router One 于 2026-10-10 上架，目录 id 是 anthropic/claude-haiku-5.5，网关同时接受 claude-haiku-5-5；截至 2026-10-10 的套餐接口，没有档位列出它，所以调用按 token 从钱包扣费。

**经 Router One 调用 Claude Haiku 5.5 多少钱？**
按 token 计费，单价以 Claude Haiku 5.5 模型页公示的输入与输出单价为准，模型页列出两条价格线：按 Anthropic 价格文档（2026-10-10 核对），提示超过 100,000 个 token 的请求按较高的那条计价，Router One 目录按同一分界列出自己的两条公示单价。思考按输出 token 计费。对比页会实时渲染它与 Claude Haiku 4.5、Gemini 3.5 Flash Lite、Claude Sonnet 5.5 的单价。截至 2026-10-10 的套餐接口，没有档位列出它，所以不论是否持有套餐，每次调用都从钱包扣费。

**Claude Haiku 5.5 在 Router One 订阅套餐里吗？**
不在。截至 2026-10-10 的套餐接口，Pro、Max、Ultra 都没有档位列出它，所以不论用哪个套餐，它的调用都按 token 从钱包扣费。Claude Haiku 4.5 仍在三个套餐的「普通模型」档；实时的套餐模型列表见价格页。

**升级 Claude Code 之后，haiku 别名的请求为什么改从钱包扣费？**
按 Claude Code 2.1.296 的更新日志与模型配置文档（2026-10-10 核对），2.1.293 及以后把 haiku 别名指向 Claude Haiku 5.5，发出 claude-haiku-5-5，而截至 2026-10-10 的套餐接口，没有档位列出它，所以 /model haiku、定义为 model: haiku 的子 agent 和内置的 claude-code-guide 子 agent 都按 token 从钱包扣费。ANTHROPIC_DEFAULT_HAIKU_MODEL=claude-haiku-4-5 这一行对所有人都是可选的：设置后，这些请求和后台任务都改用 Claude Haiku 4.5，它在三个套餐的「普通模型」档。

**为 Haiku 4.5 写的代码能直接用在 Haiku 5.5 上吗？**
不一定。在 Router One 上 Key、base URL 和端点都不变，但按 Anthropic 迁移指南（2026-10-10 核对），为 Haiku 4.5 写的代码可能要先改：把 budget_tokens 思考预算换成自适应思考加思考强度，去掉 temperature、top_p 与 top_k，用 user 轮代替 assistant 预填作为结尾，按 type 读取内容块，并重新核算 token，因为同样的文本约多计 30% 的 token。换过去之后的调用从钱包扣费，因为截至 2026-10-10 的套餐接口，没有档位列出 Claude Haiku 5.5。

**选 Claude Haiku 5.5 还是 Gemini 3.5 Flash Lite？**
按 2026-10-10 的模型目录，两者都接受文本与图像输入，上下文窗口都是 1,048,576 token；在 Router One 上的区别有两点。端点：Claude Haiku 5.5 在 /v1/messages 与 /v1/chat/completions 上提供，Gemini 3.5 Flash Lite 只在 /v1/chat/completions 上提供，所以 Claude Code 只能用 Claude Haiku 5.5。套餐：截至 2026-10-10 的套餐接口，Gemini 3.5 Flash Lite 在 Pro、Max、Ultra 的「普通模型」档，Claude Haiku 5.5 不在任何套餐档位、按钱包计费。两者的请求规则以各自厂商的文档为准，对比页并排渲染规格与实时单价。

**Codex CLI 或 Responses API 能调用 Claude Haiku 5.5 吗？**
不能。Router One 在 /v1/messages 与 /v1/chat/completions 上提供 Claude 系列，不在 /v1/responses 上提供；Codex CLI 只支持 Responses 协议，所以让它继续用 /v1/responses 上提供的 id，比如 GPT 系列，Claude Haiku 5.5 则从 Messages 或 Chat Completions 客户端调用。

**Claude Haiku 5.5 能关闭思考吗？**
在 API 上可以，但限于 high 及以下思考强度：按 Anthropic 的思考与 effort 文档（2026-10-10 核对），Claude Haiku 5.5 在 high 及以下接受 disabled 类型，在 xhigh 或 max 思考强度下发送 disabled 会返回 400，Claude Sonnet 5.5 用的 between_tools 类型在 Claude Haiku 5.5 上同样返回 400；Anthropic 认为，要拿质量换速度和成本，降低思考强度是更好的办法。在 Claude Code 里，按其模型配置文档（Claude Code 2.1.296，2026-10-10 核对），这个模型的思考无法关闭。思考 token 按输出计费、从钱包扣，所以思考强度才是控制成本的办法。

## 下一步

- 打开 [Claude Haiku 5.5 模型页](https://router.one/zh/models/claude-haiku-5-5)，查看实时单价和端点列表。
- 与 [Claude Haiku 4.5](https://router.one/zh/models/compare/claude-haiku-5-5-vs-claude-haiku-4-5)、[Gemini 3.5 Flash Lite](https://router.one/zh/models/compare/claude-haiku-5-5-vs-gemini-3-5-flash-lite) 或 [Claude Sonnet 5.5](https://router.one/zh/models/compare/claude-haiku-5-5-vs-claude-sonnet-5-5) 对比。
- Claude Sonnet 5.5 的接入方法，见 [Claude Sonnet 5.5 API 接入指南](https://router.one/zh/blog/claude-sonnet-5-5-api-guide)。
- 配置 Claude Code：[Claude Code 国内使用](https://router.one/zh/claude-code-china)与 [Claude Code 配置指南](https://router.one/zh/blog/claude-code-setup-guide)。
- 各套餐覆盖哪些模型，见[价格页](https://router.one/zh/pricing)。
- 本月目录的其他变化，见 [2026 年 10 月新模型指南](https://router.one/zh/blog/new-llm-models-october-2026)。

## 相关页面

- 本页规范地址：https://router.one/zh/blog/claude-haiku-5-5-api-guide
- Claude Code 中国：https://router.one/zh/claude-code-china
- 全部博客文章：https://router.one/zh/blog
- 模型与每模型 token 价格：https://router.one/zh/models （markdown：https://router.one/zh/models.md ）
- 定价：https://router.one/zh/pricing
- API 文档（markdown）：https://router.one/zh/docs.md
- 公司事实（markdown）：https://router.one/zh/facts/company.md
