跳到主要内容
Router One
返回博客

2026 年 9 月新模型指南:GPT-6 Astra 与 Claude Fable 5.1

发布作者Router One 团队方法说明

在 2026-09-01 与 2026-09-05 两次目录快照之间,Router One 新上架了 8 个模型 id——Claude Fable 5.1GPT-6 AstraGemini 3.8 FlashGemini 3.1 Flash Lite 及其 preview 版、Gemini 2.5 ProGrok 4.3Grok Build 0.1——同时有 12 个 id 下架;每个新模型都可以用同一把 API Key,在其详情页列出的端点系列上直接调用,国内直连、无需 VPN。

这是2026 年 8 月新模型指南的 9 月续篇,写法一致:实时目录对每个 id 公开了什么(上下文窗口、输入模态、能力标签、价格阶梯),哪些对比页把规格表并排渲染出来,以及第一个请求怎么发。快照在 2026-09-07 重新拉取过一次,id 集合没有变化——38 个 id,33 个文本模型、5 个图像模型——但 id 会来也会走,目录是唯一的事实来源,本文只是一份带日期的记录。

上了什么、下了什么

本文所有日期都是目录快照日期,不是厂商发布日期。这 8 个模型都没有干净的单独上架日可考,所以本文一个也不写。

2026-09-01 至 2026-09-05 之间上架目录 id上下文输入
Claude Fable 5.1anthropic/claude-fable-5.11,048,576文本、图像
GPT-6 Astraopenai/gpt-6-astra1,050,000文本、图像
Gemini 3.8 Flashgoogle/gemini-3.8-flash1,048,576文本、图像
Gemini 3.1 Flash Litegoogle/gemini-3.1-flash-lite1,048,576文本、图像
Gemini 3.1 Flash Lite Previewgoogle/gemini-3.1-flash-lite-preview1,048,576文本、图像
Gemini 2.5 Progoogle/gemini-2.5-pro1,048,576文本、图像
Grok 4.3grok-4.3500,000文本
Grok Build 0.1grok-build-0.1500,000文本

截至同一快照已不在目录:DeepSeek V4 Pro 与 DeepSeek V4 Flash、GLM 5.1、GLM 5.2 与 GLM 5.2 Fast、MiniMax M2.7、Doubao Seed 2.0 Lite、Doubao Seedream 5.0、Gemini 3 Pro Preview、Gemini 3.1 Pro Preview、o3 与 o4-mini。请求里填这些 id 会得到错误而不是回复,错误码页有模型不存在这一类的说明。本文不猜测 id 为什么下架,只记录目录已经不再列出它。GPT-5.6 Luna 的下架与回归 8 月那篇已经讲过,它目前仍在目录中。

Claude Fable 5.1

目录给 Claude Fable 5.1 的基础规格与 Claude Fable 5 相同:1,048,576 token 上下文窗口,输入支持文本与图像。目录条目本身没有带能力标签,所以本文也不替它声明任何能力,标签列表以模型页为准。它是 Claude 系列 id,所以在 POST /v1/messages(Claude Code 走的路径)和 POST /v1/chat/completions 上应答;系列规则写在 API 兼容性事实页,具体端点以模型页为准。

两个对比页会从实时目录渲染规格表:Claude Fable 5.1 vs Claude Opus 5 回答同系列内「比 Opus 5 更高的单价买到了什么」,Claude Fable 5.1 vs GPT-6 Astra 是两家最高档位的跨厂商对比;Claude Fable 5 vs Claude Opus 5 覆盖上一代 Fable id。目录里的 claude-*-thinking id 是独立条目,它们的推理输出按该模型公示的输出单价计费,没有单独的推理价格行(价格事实页)。

GPT-6 Astra

GPT-6 Astra 是目录里第一个 GPT-6 id。条目列出 1,050,000 token 上下文窗口、文本与图像输入,以及 chat、streaming、tool-calling、vision 四个能力标签。作为 GPT 系列 id,它在 POST /v1/responses 上原生提供服务——这是 Codex CLI 使用的协议格式,见 Codex CLI 与 Responses API 页——同时也在 POST /v1/chat/completions 上应答。

有一个计费细节应该和规格表放在一起看:Astra 在单次请求输入超过 272,000 token 时进入整单价格阶梯,门槛与 GPT-5.6 Sol 相同,所以它的模型页显示两行单价而不是一行。阶梯规则见下文。GPT-6 Astra vs GPT-5.6 Sol 是代际对比,GPT-6 Astra vs Claude Opus 5 是跨厂商对比。

Gemini 3.8 Flash、Gemini 3.1 Flash Lite 与 Gemini 2.5 Pro

三个 Gemini 名字一起到达,目录都把它们描述为 chat、tool-calling、vision 模型,1,048,576 token 上下文窗口:

  • Gemini 3.8 Flash 是目录里最新一代的 Flash,上下文窗口与输入模态和 Gemini 3.7 Flash 相同(目录给 3.7 Flash 标了能力标签,3.8 Flash 暂无,以模型页为准),核对后把现有 Flash 流量迁过去只是改一个 model 字符串。
  • Gemini 3.1 Flash Lite 有两个 id:google/gemini-3.1-flash-litegoogle/gemini-3.1-flash-lite-preview,公开规格完全一致;Gemini 3.1 Flash Lite vs GPT-5.4 mini 对比页用的是不带后缀的那个。
  • Gemini 2.5 Pro 是较早的一代,现在上架了。本文日期都是目录日期,所以它的出现不代表厂商有新发布;较早的一代是否适合你的负载,要用自己的 prompt 集来验证。

每个 Gemini id 都在 POST /v1/chat/completions 上应答;端点列表和实时单价以模型页为准。整个系列的国内接入说明见 Gemini API 国内接入页

Grok 4.3 与 Grok Build 0.1

目录把两者都描述为 xAI 文本模型——只接受文本输入、500,000 token 上下文窗口——两者都没有列出能力标签,所以本文不作任何超出目录的描述。Grok 4.3 与 Grok 4.5Grok 4.6 并列;Grok 4.6 vs Grok 4.5 覆盖已经有对比页的两个主线 id。Grok Build 0.1 是一个新名字,目录条目就是我们能担保的全部:「Build」这条线是做什么用的,目录没有说,所以 Grok Build 0.1 vs GPT-5.3 Codex Spark 对比页只按规格和单价把它与另一个 id 并排,不对用途下结论。

两个 Grok id 在单次请求输入超过 200,000 token 时都进入整单阶梯,门槛与 Grok 4.6 相同。系列的国内接入说明见 Grok API 国内接入页

整单价格阶梯怎么算

本快照里有五个文本 id 列出了第二行单价——GPT-6 Astra 与 GPT-5.6 Sol 在输入超过 272,000 token 时,Grok 4.3、Grok Build 0.1 与 Grok 4.6 在超过 200,000 token 时——规则对它们都一样:用单次请求的全部输入 token 数选择阶梯,恰好等于门槛时仍按较低档,严格超过门槛后,选中阶梯的单价适用于整次请求(包括输出),而不是只对超出部分加价;整月用量不参与选档。价格方法页有完整说明,成本计算器按单次请求套用这条规则,Prompt Caching 核对指南则讲清楚 usage 里的缓存写入、缓存读取怎么读,避免把输入算两遍。

价格在哪里

不在本文。博客里印的每 token 单价几周内就会过时,所以实时单价和阶梯边界都在模型目录和各模型页上;价格页写明定位——部分模型最低官方价 1 折(最高省 90%)——价格事实页写明计费规则。单价按 id 不同且会变化,请从页面读、不要凭记忆,更不要凭一份按早已变动的数字给模型排序的对比。

哪个端点服务哪个 id

端点系列之间不能互换。POST /v1/chat/completions 服务目录里所有对话模型;POST /v1/messages 服务当前在售的 Claude 系列 id;POST /v1/responses 对当前在售的 GPT 系列 id 原生提供服务。把 id 发到不服务它的端点,会在调用任何模型之前被拒绝,返回 HTTP 400 invalid_request_error,错误信息里会点名应该用的路径。对这一批模型来说:Claude Fable 5.1 走 Messages 或 Chat Completions;GPT-6 Astra 走 Responses 或 Chat Completions;Gemini 与 Grok 各 id 走 Chat Completions。请求形状见 OpenAI 兼容 API 页,每个模型页都列出它实际服务的端点。

五分钟试一个

  1. 创建 Key。 Dashboard → API Keys → New key。Key 形如 sk-rk-...。如果只是做实验,给这把 Key 设一个 maxSpend 消费上限,失控循环会停在你定的数字上(按 Key 成本追踪)。
  2. 设 base URL。 OpenAI 兼容客户端和 SDK 用 https://api.router.one/v1;Anthropic SDK 和 Claude Code 的 ANTHROPIC_BASE_URL 只填主机名 https://api.router.one,它们会自己拼上 /v1/messages
  3. 每个系列发一个请求。

用 GPT id 调 Chat Completions:

curl https://api.router.one/v1/chat/completions \
  -H "Authorization: Bearer sk-your-api-key" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "openai/gpt-6-astra",
    "messages": [{"role": "user", "content": "用两句话解释什么是整单价格阶梯。"}]
  }'

用 Claude id 调 Messages:

curl https://api.router.one/v1/messages \
  -H "Authorization: Bearer sk-your-api-key" \
  -H "anthropic-version: 2023-06-01" \
  -H "content-type: application/json" \
  -d '{
    "model": "anthropic/claude-fable-5.1",
    "max_tokens": 1024,
    "messages": [{"role": "user", "content": "用两句话解释什么是整单价格阶梯。"}]
  }'
  1. 看 Trace。 Dashboard → Logs 里两次调用都在,带模型、输入输出 token、费用、延迟和状态,「两个模型里哪个每解决一个任务更便宜」就变成一个筛选条件,而不是一张表(每请求可观测)。可重试的上游故障由同一模型多条候选线路之间的自动故障转移消化,stream: true 的用法见流式输出指南

充值可用支付宝或银行卡在同一个托管收银台完成,也支持 6 条链上的 USDT/USDC(Tron、BSC、以太坊、Polygon、Base、Arbitrum),无需美国信用卡。中国大陆可直连,无需 VPN。

先 A/B 哪一对

这不是排名——对比页渲染的是实时规格表和单价,最终由你自己的 prompt 集决定。两家最高档位的对比看 Claude Fable 5.1 vs Claude Opus 5GPT-6 Astra vs Claude Opus 5;想知道 GPT-6 这一代相对 GPT-5.6 改了什么,看 GPT-6 Astra vs GPT-5.6 Sol;大批量负载看 Gemini 3.1 Flash Lite vs GPT-5.4 mini;xAI 的新名字对一个熟悉的 id,看 Grok Build 0.1 vs GPT-5.3 Codex Spark。选定之后接进 Claude Code(配置)、Codex CLI(配置)、CursorZedContinue 只需一次——它们指向的都是同一个统一 LLM API 网关

常见问题

DeepSeek、GLM 或 MiniMax 的模型还能经 Router One 调用吗? 截至本快照不能。DeepSeek V4 Pro 与 Flash、GLM 5.1、5.2 与 5.2 Fast、MiniMax M2.7 截至 2026-09-05 已不在目录,2026-09-07 重新拉取的 id 集合也一样。/models 的实时目录是唯一事实来源:id 会来也会走,一篇文章不能替它作任何方向的承诺。

GPT-6 Astra 和 Claude Fable 5.1 各用哪个端点? GPT-6 Astra 是 GPT 系列 id,在 /v1/responses 上原生提供服务,也在 /v1/chat/completions 上应答。Claude Fable 5.1 是 Claude 系列 id,在 /v1/messages 和 /v1/chat/completions 上应答。把 id 发到不服务它的端点,会在调用任何模型之前返回 HTTP 400 invalid_request_error,错误信息里写明正确路径。

长上下文阶梯只对超出门槛的 token 生效吗? 不是。用单次请求的全部输入 token 数选择阶梯;恰好等于门槛时仍按较低档,严格超过后,选中阶梯的单价适用于整次请求,包括输出。整月用量不参与选档。GPT-6 Astra 与 GPT-5.6 Sol 的门槛是 272,000 输入 token;Grok 4.3、Grok Build 0.1 与 Grok 4.6 是 200,000。

这些新模型经 Router One 调用是什么价格? 本文刻意不印任何每 token 单价,因为它们会过期。每个模型页都有实时单价和阶梯边界,部分模型最低官方价 1 折(最高省 90%)。

Gemini 2.5 Pro 是 2026 年 9 月的新模型吗? 不是。它出现在本快照里是目录上架,不是厂商发布;本文所有日期都是目录快照日期。它的实时单价和端点见模型页。

下一步

相关权威页面

这篇文章归入「LLM API 网关与路由」主题,以下页面作为商业页、配置文档、证据页和信任事实源。

商业主页面Router One API 网关承接统一模型调用、路由、fallback、预算和观测的产品首页。API 文档Router One API 文档OpenAI 兼容端点、CLI 配置和模型调用示例。证据页智能路由方法论路由信号、最终模型与 provider,以及客户侧 trace 的字段边界。对比页OpenRouter 替代方案专业对比全球模型目录与中国友好路由、支付能力的差异。信任页可引用事实表面向搜索爬虫、AI 答案引擎和客户的稳定事实源。数据留存数据留存政策prompt/completion 留存边界和请求元数据政策。网关页面统一 LLM API 网关一个 OpenAI 兼容端点接入整个模型目录,含路由、fallback 与预算控制。路由页面智能模型路由候选排序如何使用延迟、公示成本与可靠性信号。故障转移页面LLM 供应商故障转移什么样的请求才符合在另一条健康供应商路由上重试的条件。可观测页面逐请求 Trace 日志每个请求的最终模型与供应商、Token、延迟、状态与报错。兼容性页面OpenAI 兼容端点沿用 OpenAI SDK,只改 base URL 即可触达各个模型系列。成本追踪页面LLM 成本追踪按 Key、按模型、按请求的花费归因,配合硬性消费上限。转售方页面在 Router One 上搭你自己的 API 服务带消费上限的客户 Key、按 Key 的用量归因,以及明确的「不提供」清单。客户端接入SDK 与客户端配置指南把任意编程 agent、SDK、聊天客户端或 LLM 应用平台指向同一个端点,每个都有专属指南。模型对比模型价格与上下文两两对比每百万 token 单价、上下文窗口与能力,渲染自实时模型目录。

相关阅读