在 2026-09-01 与 2026-09-05 两次目录快照之间,Router One 新上架了 8 个模型 id——Claude Fable 5.1、GPT-6 Astra、Gemini 3.8 Flash、Gemini 3.1 Flash Lite 及其 preview 版、Gemini 2.5 Pro、Grok 4.3 与 Grok Build 0.1——同时有 12 个 id 下架;每个新模型都可以用同一把 API Key,在其详情页列出的端点系列上直接调用,国内直连、无需 VPN。
这是2026 年 8 月新模型指南的 9 月续篇,写法一致:实时目录对每个 id 公开了什么(上下文窗口、输入模态、能力标签、价格阶梯),哪些对比页把规格表并排渲染出来,以及第一个请求怎么发。快照在 2026-09-07 重新拉取过一次,id 集合没有变化——38 个 id,33 个文本模型、5 个图像模型——但 id 会来也会走,目录是唯一的事实来源,本文只是一份带日期的记录。
上了什么、下了什么
本文所有日期都是目录快照日期,不是厂商发布日期。这 8 个模型都没有干净的单独上架日可考,所以本文一个也不写。
| 2026-09-01 至 2026-09-05 之间上架 | 目录 id | 上下文 | 输入 |
|---|---|---|---|
| Claude Fable 5.1 | anthropic/claude-fable-5.1 | 1,048,576 | 文本、图像 |
| GPT-6 Astra | openai/gpt-6-astra | 1,050,000 | 文本、图像 |
| Gemini 3.8 Flash | google/gemini-3.8-flash | 1,048,576 | 文本、图像 |
| Gemini 3.1 Flash Lite | google/gemini-3.1-flash-lite | 1,048,576 | 文本、图像 |
| Gemini 3.1 Flash Lite Preview | google/gemini-3.1-flash-lite-preview | 1,048,576 | 文本、图像 |
| Gemini 2.5 Pro | google/gemini-2.5-pro | 1,048,576 | 文本、图像 |
| Grok 4.3 | grok-4.3 | 500,000 | 文本 |
| Grok Build 0.1 | grok-build-0.1 | 500,000 | 文本 |
截至同一快照已不在目录:DeepSeek V4 Pro 与 DeepSeek V4 Flash、GLM 5.1、GLM 5.2 与 GLM 5.2 Fast、MiniMax M2.7、Doubao Seed 2.0 Lite、Doubao Seedream 5.0、Gemini 3 Pro Preview、Gemini 3.1 Pro Preview、o3 与 o4-mini。请求里填这些 id 会得到错误而不是回复,错误码页有模型不存在这一类的说明。本文不猜测 id 为什么下架,只记录目录已经不再列出它。GPT-5.6 Luna 的下架与回归 8 月那篇已经讲过,它目前仍在目录中。
Claude Fable 5.1
目录给 Claude Fable 5.1 的基础规格与 Claude Fable 5 相同:1,048,576 token 上下文窗口,输入支持文本与图像。目录条目本身没有带能力标签,所以本文也不替它声明任何能力,标签列表以模型页为准。它是 Claude 系列 id,所以在 POST /v1/messages(Claude Code 走的路径)和 POST /v1/chat/completions 上应答;系列规则写在 API 兼容性事实页,具体端点以模型页为准。
两个对比页会从实时目录渲染规格表:Claude Fable 5.1 vs Claude Opus 5 回答同系列内「比 Opus 5 更高的单价买到了什么」,Claude Fable 5.1 vs GPT-6 Astra 是两家最高档位的跨厂商对比;Claude Fable 5 vs Claude Opus 5 覆盖上一代 Fable id。目录里的 claude-*-thinking id 是独立条目,它们的推理输出按该模型公示的输出单价计费,没有单独的推理价格行(价格事实页)。
GPT-6 Astra
GPT-6 Astra 是目录里第一个 GPT-6 id。条目列出 1,050,000 token 上下文窗口、文本与图像输入,以及 chat、streaming、tool-calling、vision 四个能力标签。作为 GPT 系列 id,它在 POST /v1/responses 上原生提供服务——这是 Codex CLI 使用的协议格式,见 Codex CLI 与 Responses API 页——同时也在 POST /v1/chat/completions 上应答。
有一个计费细节应该和规格表放在一起看:Astra 在单次请求输入超过 272,000 token 时进入整单价格阶梯,门槛与 GPT-5.6 Sol 相同,所以它的模型页显示两行单价而不是一行。阶梯规则见下文。GPT-6 Astra vs GPT-5.6 Sol 是代际对比,GPT-6 Astra vs Claude Opus 5 是跨厂商对比。
Gemini 3.8 Flash、Gemini 3.1 Flash Lite 与 Gemini 2.5 Pro
三个 Gemini 名字一起到达,目录都把它们描述为 chat、tool-calling、vision 模型,1,048,576 token 上下文窗口:
- Gemini 3.8 Flash 是目录里最新一代的 Flash,上下文窗口与输入模态和 Gemini 3.7 Flash 相同(目录给 3.7 Flash 标了能力标签,3.8 Flash 暂无,以模型页为准),核对后把现有 Flash 流量迁过去只是改一个
model字符串。 - Gemini 3.1 Flash Lite 有两个 id:
google/gemini-3.1-flash-lite与google/gemini-3.1-flash-lite-preview,公开规格完全一致;Gemini 3.1 Flash Lite vs GPT-5.4 mini 对比页用的是不带后缀的那个。 - Gemini 2.5 Pro 是较早的一代,现在上架了。本文日期都是目录日期,所以它的出现不代表厂商有新发布;较早的一代是否适合你的负载,要用自己的 prompt 集来验证。
每个 Gemini id 都在 POST /v1/chat/completions 上应答;端点列表和实时单价以模型页为准。整个系列的国内接入说明见 Gemini API 国内接入页。
Grok 4.3 与 Grok Build 0.1
目录把两者都描述为 xAI 文本模型——只接受文本输入、500,000 token 上下文窗口——两者都没有列出能力标签,所以本文不作任何超出目录的描述。Grok 4.3 与 Grok 4.5、Grok 4.6 并列;Grok 4.6 vs Grok 4.5 覆盖已经有对比页的两个主线 id。Grok Build 0.1 是一个新名字,目录条目就是我们能担保的全部:「Build」这条线是做什么用的,目录没有说,所以 Grok Build 0.1 vs GPT-5.3 Codex Spark 对比页只按规格和单价把它与另一个 id 并排,不对用途下结论。
两个 Grok id 在单次请求输入超过 200,000 token 时都进入整单阶梯,门槛与 Grok 4.6 相同。系列的国内接入说明见 Grok API 国内接入页。
整单价格阶梯怎么算
本快照里有五个文本 id 列出了第二行单价——GPT-6 Astra 与 GPT-5.6 Sol 在输入超过 272,000 token 时,Grok 4.3、Grok Build 0.1 与 Grok 4.6 在超过 200,000 token 时——规则对它们都一样:用单次请求的全部输入 token 数选择阶梯,恰好等于门槛时仍按较低档,严格超过门槛后,选中阶梯的单价适用于整次请求(包括输出),而不是只对超出部分加价;整月用量不参与选档。价格方法页有完整说明,成本计算器按单次请求套用这条规则,Prompt Caching 核对指南则讲清楚 usage 里的缓存写入、缓存读取怎么读,避免把输入算两遍。
价格在哪里
不在本文。博客里印的每 token 单价几周内就会过时,所以实时单价和阶梯边界都在模型目录和各模型页上;价格页写明定位——部分模型最低官方价 1 折(最高省 90%)——价格事实页写明计费规则。单价按 id 不同且会变化,请从页面读、不要凭记忆,更不要凭一份按早已变动的数字给模型排序的对比。
哪个端点服务哪个 id
端点系列之间不能互换。POST /v1/chat/completions 服务目录里所有对话模型;POST /v1/messages 服务当前在售的 Claude 系列 id;POST /v1/responses 对当前在售的 GPT 系列 id 原生提供服务。把 id 发到不服务它的端点,会在调用任何模型之前被拒绝,返回 HTTP 400 invalid_request_error,错误信息里会点名应该用的路径。对这一批模型来说:Claude Fable 5.1 走 Messages 或 Chat Completions;GPT-6 Astra 走 Responses 或 Chat Completions;Gemini 与 Grok 各 id 走 Chat Completions。请求形状见 OpenAI 兼容 API 页,每个模型页都列出它实际服务的端点。
五分钟试一个
- 创建 Key。 Dashboard → API Keys → New key。Key 形如
sk-rk-...。如果只是做实验,给这把 Key 设一个maxSpend消费上限,失控循环会停在你定的数字上(按 Key 成本追踪)。 - 设 base URL。 OpenAI 兼容客户端和 SDK 用
https://api.router.one/v1;Anthropic SDK 和 Claude Code 的ANTHROPIC_BASE_URL只填主机名https://api.router.one,它们会自己拼上/v1/messages。 - 每个系列发一个请求。
用 GPT id 调 Chat Completions:
curl https://api.router.one/v1/chat/completions \
-H "Authorization: Bearer sk-your-api-key" \
-H "Content-Type: application/json" \
-d '{
"model": "openai/gpt-6-astra",
"messages": [{"role": "user", "content": "用两句话解释什么是整单价格阶梯。"}]
}'
用 Claude id 调 Messages:
curl https://api.router.one/v1/messages \
-H "Authorization: Bearer sk-your-api-key" \
-H "anthropic-version: 2023-06-01" \
-H "content-type: application/json" \
-d '{
"model": "anthropic/claude-fable-5.1",
"max_tokens": 1024,
"messages": [{"role": "user", "content": "用两句话解释什么是整单价格阶梯。"}]
}'
- 看 Trace。 Dashboard → Logs 里两次调用都在,带模型、输入输出 token、费用、延迟和状态,「两个模型里哪个每解决一个任务更便宜」就变成一个筛选条件,而不是一张表(每请求可观测)。可重试的上游故障由同一模型多条候选线路之间的自动故障转移消化,
stream: true的用法见流式输出指南。
充值可用支付宝或银行卡在同一个托管收银台完成,也支持 6 条链上的 USDT/USDC(Tron、BSC、以太坊、Polygon、Base、Arbitrum),无需美国信用卡。中国大陆可直连,无需 VPN。
先 A/B 哪一对
这不是排名——对比页渲染的是实时规格表和单价,最终由你自己的 prompt 集决定。两家最高档位的对比看 Claude Fable 5.1 vs Claude Opus 5 和 GPT-6 Astra vs Claude Opus 5;想知道 GPT-6 这一代相对 GPT-5.6 改了什么,看 GPT-6 Astra vs GPT-5.6 Sol;大批量负载看 Gemini 3.1 Flash Lite vs GPT-5.4 mini;xAI 的新名字对一个熟悉的 id,看 Grok Build 0.1 vs GPT-5.3 Codex Spark。选定之后接进 Claude Code(配置)、Codex CLI(配置)、Cursor、Zed 或 Continue 只需一次——它们指向的都是同一个统一 LLM API 网关。
常见问题
DeepSeek、GLM 或 MiniMax 的模型还能经 Router One 调用吗? 截至本快照不能。DeepSeek V4 Pro 与 Flash、GLM 5.1、5.2 与 5.2 Fast、MiniMax M2.7 截至 2026-09-05 已不在目录,2026-09-07 重新拉取的 id 集合也一样。/models 的实时目录是唯一事实来源:id 会来也会走,一篇文章不能替它作任何方向的承诺。
GPT-6 Astra 和 Claude Fable 5.1 各用哪个端点? GPT-6 Astra 是 GPT 系列 id,在 /v1/responses 上原生提供服务,也在 /v1/chat/completions 上应答。Claude Fable 5.1 是 Claude 系列 id,在 /v1/messages 和 /v1/chat/completions 上应答。把 id 发到不服务它的端点,会在调用任何模型之前返回 HTTP 400 invalid_request_error,错误信息里写明正确路径。
长上下文阶梯只对超出门槛的 token 生效吗? 不是。用单次请求的全部输入 token 数选择阶梯;恰好等于门槛时仍按较低档,严格超过后,选中阶梯的单价适用于整次请求,包括输出。整月用量不参与选档。GPT-6 Astra 与 GPT-5.6 Sol 的门槛是 272,000 输入 token;Grok 4.3、Grok Build 0.1 与 Grok 4.6 是 200,000。
这些新模型经 Router One 调用是什么价格? 本文刻意不印任何每 token 单价,因为它们会过期。每个模型页都有实时单价和阶梯边界,部分模型最低官方价 1 折(最高省 90%)。
Gemini 2.5 Pro 是 2026 年 9 月的新模型吗? 不是。它出现在本快照里是目录上架,不是厂商发布;本文所有日期都是目录快照日期。它的实时单价和端点见模型页。
下一步
- 上一批模型——Claude Opus 5、GPT-5.6 家族与 Grok 4.6——见 2026 年 8 月指南。
- 在模型目录里挑一个 id,查看它的端点、阶梯边界和实时单价;折扣口径见价格页。
- 用 Codex 与 Responses API 指南把 Codex CLI 指向一个 GPT id,或按 Claude Code 国内接入把 Claude Code 指向一个 Claude id。