> https://router.one/zh/blog/new-llm-models-september-2026 的 Markdown 镜像，供 AI 助手与爬虫使用。Router One 是 OpenAI 兼容的统一 LLM API 网关。
> 发布：2026-09-07 · 作者：Router One Team

# 2026 年 9 月新模型指南：GPT-6 Astra 与 Claude Fable 5.1

_2026 年 9 月目录快照：GPT-6 Astra、Claude Fable 5.1、Gemini 3.8 Flash、Grok 4.3 与 Grok Build 0.1 上架，哪些模型下架，以及一把 Key 五分钟试用。_

在 2026-09-01 与 2026-09-05 两次目录快照之间，Router One 新上架了 8 个模型 id——[Claude Fable 5.1](https://router.one/zh/models/claude-fable-5-1)、[GPT-6 Astra](https://router.one/zh/models/gpt-6-astra)、[Gemini 3.8 Flash](https://router.one/zh/models/gemini-3-8-flash)、[Gemini 3.1 Flash Lite](https://router.one/zh/models/gemini-3-1-flash-lite) 及其 preview 版、[Gemini 2.5 Pro](https://router.one/zh/models/gemini-2-5-pro)、[Grok 4.3](https://router.one/zh/models/grok-4-3) 与 [Grok Build 0.1](https://router.one/zh/models/grok-build-0-1)——同时有 12 个 id 下架；每个新模型都可以用同一把 API Key，在其详情页列出的端点系列上直接调用，国内直连、无需 VPN。

这是[2026 年 8 月新模型指南](https://router.one/zh/blog/new-llm-models-august-2026)的 9 月续篇，写法一致：[实时目录](https://router.one/zh/models)对每个 id 公开了什么（上下文窗口、输入模态、能力标签、价格阶梯），哪些对比页把规格表并排渲染出来，以及第一个请求怎么发。快照在 2026-09-07 重新拉取过一次，id 集合没有变化——38 个 id，33 个文本模型、5 个图像模型——但 id 会来也会走，目录是唯一的事实来源，本文只是一份带日期的记录。

## 上了什么、下了什么

本文所有日期都是目录快照日期，不是厂商发布日期。这 8 个模型都没有干净的单独上架日可考，所以本文一个也不写。

| 2026-09-01 至 2026-09-05 之间上架 | 目录 id | 上下文 | 输入 |
| --- | --- | --- | --- |
| [Claude Fable 5.1](https://router.one/zh/models/claude-fable-5-1) | `anthropic/claude-fable-5.1` | 1,048,576 | 文本、图像 |
| [GPT-6 Astra](https://router.one/zh/models/gpt-6-astra) | `openai/gpt-6-astra` | 1,050,000 | 文本、图像 |
| [Gemini 3.8 Flash](https://router.one/zh/models/gemini-3-8-flash) | `google/gemini-3.8-flash` | 1,048,576 | 文本、图像 |
| [Gemini 3.1 Flash Lite](https://router.one/zh/models/gemini-3-1-flash-lite) | `google/gemini-3.1-flash-lite` | 1,048,576 | 文本、图像 |
| [Gemini 3.1 Flash Lite Preview](https://router.one/zh/models/gemini-3-1-flash-lite-preview) | `google/gemini-3.1-flash-lite-preview` | 1,048,576 | 文本、图像 |
| [Gemini 2.5 Pro](https://router.one/zh/models/gemini-2-5-pro) | `google/gemini-2.5-pro` | 1,048,576 | 文本、图像 |
| [Grok 4.3](https://router.one/zh/models/grok-4-3) | `grok-4.3` | 500,000 | 文本 |
| [Grok Build 0.1](https://router.one/zh/models/grok-build-0-1) | `grok-build-0.1` | 500,000 | 文本 |

截至同一快照已不在目录：DeepSeek V4 Pro 与 DeepSeek V4 Flash、GLM 5.1、GLM 5.2 与 GLM 5.2 Fast、MiniMax M2.7、Doubao Seed 2.0 Lite、Doubao Seedream 5.0、Gemini 3 Pro Preview、Gemini 3.1 Pro Preview、o3 与 o4-mini。请求里填这些 id 会得到错误而不是回复，[错误码页](https://router.one/zh/llm-api-error-codes)有模型不存在这一类的说明。本文不猜测 id 为什么下架，只记录目录已经不再列出它。GPT-5.6 Luna 的下架与回归 8 月那篇已经讲过，它目前仍在目录中。

## Claude Fable 5.1

目录给 Claude Fable 5.1 的基础规格与 [Claude Fable 5](https://router.one/zh/models/claude-fable-5) 相同：1,048,576 token 上下文窗口，输入支持文本与图像。目录条目本身没有带能力标签，所以本文也不替它声明任何能力，标签列表以模型页为准。它是 Claude 系列 id，所以在 `POST /v1/messages`（Claude Code 走的路径）和 `POST /v1/chat/completions` 上应答；系列规则写在 [API 兼容性事实页](https://router.one/zh/facts/api-compatibility.md)，具体端点以模型页为准。

两个对比页会从实时目录渲染规格表：[Claude Fable 5.1 vs Claude Opus 5](https://router.one/zh/models/compare/claude-fable-5-1-vs-claude-opus-5) 回答同系列内「比 Opus 5 更高的单价买到了什么」，[Claude Fable 5.1 vs GPT-6 Astra](https://router.one/zh/models/compare/claude-fable-5-1-vs-gpt-6-astra) 是两家最高档位的跨厂商对比；[Claude Fable 5 vs Claude Opus 5](https://router.one/zh/models/compare/claude-fable-5-vs-claude-opus-5) 覆盖上一代 Fable id。目录里的 `claude-*-thinking` id 是独立条目，它们的推理输出按该模型公示的输出单价计费，没有单独的推理价格行（[价格事实页](https://router.one/zh/facts/pricing.md)）。

## GPT-6 Astra

GPT-6 Astra 是目录里第一个 GPT-6 id。条目列出 1,050,000 token 上下文窗口、文本与图像输入，以及 chat、streaming、tool-calling、vision 四个能力标签。作为 GPT 系列 id，它在 `POST /v1/responses` 上原生提供服务——这是 Codex CLI 使用的协议格式，见 [Codex CLI 与 Responses API 页](https://router.one/zh/codex-responses-api)——同时也在 `POST /v1/chat/completions` 上应答。

有一个计费细节应该和规格表放在一起看：Astra 在单次请求输入超过 272,000 token 时进入整单价格阶梯，门槛与 [GPT-5.6 Sol](https://router.one/zh/models/gpt-5-6-sol) 相同，所以它的模型页显示两行单价而不是一行。阶梯规则见下文。[GPT-6 Astra vs GPT-5.6 Sol](https://router.one/zh/models/compare/gpt-6-astra-vs-gpt-5-6-sol) 是代际对比，[GPT-6 Astra vs Claude Opus 5](https://router.one/zh/models/compare/gpt-6-astra-vs-claude-opus-5) 是跨厂商对比。

## Gemini 3.8 Flash、Gemini 3.1 Flash Lite 与 Gemini 2.5 Pro

三个 Gemini 名字一起到达，目录都把它们描述为 chat、tool-calling、vision 模型，1,048,576 token 上下文窗口：

- **Gemini 3.8 Flash** 是目录里最新一代的 Flash，上下文窗口与输入模态和 [Gemini 3.7 Flash](https://router.one/zh/models/gemini-3-7-flash) 相同（目录给 3.7 Flash 标了能力标签，3.8 Flash 暂无，以模型页为准），核对后把现有 Flash 流量迁过去只是改一个 `model` 字符串。
- **Gemini 3.1 Flash Lite** 有两个 id：`google/gemini-3.1-flash-lite` 与 `google/gemini-3.1-flash-lite-preview`，公开规格完全一致；[Gemini 3.1 Flash Lite vs GPT-5.4 mini](https://router.one/zh/models/compare/gemini-3-1-flash-lite-vs-gpt-5-4-mini) 对比页用的是不带后缀的那个。
- **Gemini 2.5 Pro** 是较早的一代，现在上架了。本文日期都是目录日期，所以它的出现不代表厂商有新发布；较早的一代是否适合你的负载，要用自己的 prompt 集来验证。

每个 Gemini id 都在 `POST /v1/chat/completions` 上应答；端点列表和实时单价以模型页为准。整个系列的国内接入说明见 [Gemini API 国内接入页](https://router.one/zh/gemini-api-china)。

## Grok 4.3 与 Grok Build 0.1

目录把两者都描述为 xAI 文本模型——只接受文本输入、500,000 token 上下文窗口——两者都没有列出能力标签，所以本文不作任何超出目录的描述。Grok 4.3 与 [Grok 4.5](https://router.one/zh/models/grok-4-5)、[Grok 4.6](https://router.one/zh/models/grok-4-6) 并列；[Grok 4.6 vs Grok 4.5](https://router.one/zh/models/compare/grok-4-6-vs-grok-4-5) 覆盖已经有对比页的两个主线 id。Grok Build 0.1 是一个新名字，目录条目就是我们能担保的全部：「Build」这条线是做什么用的，目录没有说，所以 [Grok Build 0.1 vs GPT-5.3 Codex Spark](https://router.one/zh/models/compare/grok-build-0-1-vs-gpt-5-3-codex-spark) 对比页只按规格和单价把它与另一个 id 并排，不对用途下结论。

两个 Grok id 在单次请求输入超过 200,000 token 时都进入整单阶梯，门槛与 Grok 4.6 相同。系列的国内接入说明见 [Grok API 国内接入页](https://router.one/zh/grok-api-china)。

## 整单价格阶梯怎么算

本快照里有五个文本 id 列出了第二行单价——GPT-6 Astra 与 GPT-5.6 Sol 在输入超过 272,000 token 时，Grok 4.3、Grok Build 0.1 与 Grok 4.6 在超过 200,000 token 时——规则对它们都一样：用单次请求的全部输入 token 数选择阶梯，恰好等于门槛时仍按较低档，严格超过门槛后，选中阶梯的单价适用于整次请求（包括输出），而不是只对超出部分加价；整月用量不参与选档。[价格方法页](https://router.one/zh/pricing-methodology)有完整说明，[成本计算器](https://router.one/zh/llm-cost-calculator)按单次请求套用这条规则，[Prompt Caching 核对指南](https://router.one/zh/llm-prompt-caching)则讲清楚 `usage` 里的缓存写入、缓存读取怎么读，避免把输入算两遍。

## 价格在哪里

不在本文。博客里印的每 token 单价几周内就会过时，所以实时单价和阶梯边界都在[模型目录](https://router.one/zh/models)和各模型页上；[价格页](https://router.one/zh/pricing)写明定位——部分模型最低官方价 1 折（最高省 90%）——[价格事实页](https://router.one/zh/facts/pricing.md)写明计费规则。单价按 id 不同且会变化，请从页面读、不要凭记忆，更不要凭一份按早已变动的数字给模型排序的对比。

## 哪个端点服务哪个 id

端点系列之间不能互换。`POST /v1/chat/completions` 服务目录里所有对话模型；`POST /v1/messages` 服务当前在售的 Claude 系列 id；`POST /v1/responses` 对当前在售的 GPT 系列 id 原生提供服务。把 id 发到不服务它的端点，会在调用任何模型之前被拒绝，返回 HTTP 400 `invalid_request_error`，错误信息里会点名应该用的路径。对这一批模型来说：Claude Fable 5.1 走 Messages 或 Chat Completions；GPT-6 Astra 走 Responses 或 Chat Completions；Gemini 与 Grok 各 id 走 Chat Completions。请求形状见 [OpenAI 兼容 API 页](https://router.one/zh/openai-compatible-api)，每个模型页都列出它实际服务的端点。

## 五分钟试一个

1. **创建 Key。** Dashboard → API Keys → New key。Key 形如 `sk-rk-...`。如果只是做实验，给这把 Key 设一个 `maxSpend` 消费上限，失控循环会停在你定的数字上（[按 Key 成本追踪](https://router.one/zh/llm-cost-tracking)）。
2. **设 base URL。** OpenAI 兼容客户端和 SDK 用 `https://api.router.one/v1`；Anthropic SDK 和 Claude Code 的 `ANTHROPIC_BASE_URL` 只填主机名 `https://api.router.one`，它们会自己拼上 `/v1/messages`。
3. **每个系列发一个请求。**

用 GPT id 调 Chat Completions：

```bash
curl https://api.router.one/v1/chat/completions \
  -H "Authorization: Bearer sk-your-api-key" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "openai/gpt-6-astra",
    "messages": [{"role": "user", "content": "用两句话解释什么是整单价格阶梯。"}]
  }'
```

用 Claude id 调 Messages：

```bash
curl https://api.router.one/v1/messages \
  -H "Authorization: Bearer sk-your-api-key" \
  -H "anthropic-version: 2023-06-01" \
  -H "content-type: application/json" \
  -d '{
    "model": "anthropic/claude-fable-5.1",
    "max_tokens": 1024,
    "messages": [{"role": "user", "content": "用两句话解释什么是整单价格阶梯。"}]
  }'
```

4. **看 Trace。** Dashboard → Logs 里两次调用都在，带模型、输入输出 token、费用、延迟和状态，「两个模型里哪个每解决一个任务更便宜」就变成一个筛选条件，而不是一张表（[每请求可观测](https://router.one/zh/llm-observability)）。可重试的上游故障由同一模型多条候选线路之间的[自动故障转移](https://router.one/zh/llm-fallback)消化，`stream: true` 的用法见[流式输出指南](https://router.one/zh/llm-streaming)。

充值可用支付宝或银行卡在同一个托管收银台完成，也支持 6 条链上的 USDT/USDC（Tron、BSC、以太坊、Polygon、Base、Arbitrum），无需美国信用卡。中国大陆可直连，无需 VPN。

## 先 A/B 哪一对

这不是排名——对比页渲染的是实时规格表和单价，最终由你自己的 prompt 集决定。两家最高档位的对比看 [Claude Fable 5.1 vs Claude Opus 5](https://router.one/zh/models/compare/claude-fable-5-1-vs-claude-opus-5) 和 [GPT-6 Astra vs Claude Opus 5](https://router.one/zh/models/compare/gpt-6-astra-vs-claude-opus-5)；想知道 GPT-6 这一代相对 GPT-5.6 改了什么，看 [GPT-6 Astra vs GPT-5.6 Sol](https://router.one/zh/models/compare/gpt-6-astra-vs-gpt-5-6-sol)；大批量负载看 [Gemini 3.1 Flash Lite vs GPT-5.4 mini](https://router.one/zh/models/compare/gemini-3-1-flash-lite-vs-gpt-5-4-mini)；xAI 的新名字对一个熟悉的 id，看 [Grok Build 0.1 vs GPT-5.3 Codex Spark](https://router.one/zh/models/compare/grok-build-0-1-vs-gpt-5-3-codex-spark)。选定之后接进 Claude Code（[配置](https://router.one/zh/claude-code-china)）、Codex CLI（[配置](https://router.one/zh/codex-china)）、[Cursor](https://router.one/zh/integrations/cursor)、[Zed](https://router.one/zh/integrations/zed) 或 [Continue](https://router.one/zh/integrations/continue) 只需一次——它们指向的都是同一个[统一 LLM API 网关](https://router.one/zh/llm-api-gateway)。

## 常见问题

**DeepSeek、GLM 或 MiniMax 的模型还能经 Router One 调用吗？**
截至本快照不能。DeepSeek V4 Pro 与 Flash、GLM 5.1、5.2 与 5.2 Fast、MiniMax M2.7 截至 2026-09-05 已不在目录，2026-09-07 重新拉取的 id 集合也一样。/models 的实时目录是唯一事实来源：id 会来也会走，一篇文章不能替它作任何方向的承诺。

**GPT-6 Astra 和 Claude Fable 5.1 各用哪个端点？**
GPT-6 Astra 是 GPT 系列 id，在 /v1/responses 上原生提供服务，也在 /v1/chat/completions 上应答。Claude Fable 5.1 是 Claude 系列 id，在 /v1/messages 和 /v1/chat/completions 上应答。把 id 发到不服务它的端点，会在调用任何模型之前返回 HTTP 400 invalid_request_error，错误信息里写明正确路径。

**长上下文阶梯只对超出门槛的 token 生效吗？**
不是。用单次请求的全部输入 token 数选择阶梯；恰好等于门槛时仍按较低档，严格超过后，选中阶梯的单价适用于整次请求，包括输出。整月用量不参与选档。GPT-6 Astra 与 GPT-5.6 Sol 的门槛是 272,000 输入 token；Grok 4.3、Grok Build 0.1 与 Grok 4.6 是 200,000。

**这些新模型经 Router One 调用是什么价格？**
本文刻意不印任何每 token 单价，因为它们会过期。每个模型页都有实时单价和阶梯边界，部分模型最低官方价 1 折（最高省 90%）。

**Gemini 2.5 Pro 是 2026 年 9 月的新模型吗？**
不是。它出现在本快照里是目录上架，不是厂商发布；本文所有日期都是目录快照日期。它的实时单价和端点见模型页。

## 下一步

- 上一批模型——Claude Opus 5、GPT-5.6 家族与 Grok 4.6——见 [2026 年 8 月指南](https://router.one/zh/blog/new-llm-models-august-2026)。
- 在[模型目录](https://router.one/zh/models)里挑一个 id，查看它的端点、阶梯边界和实时单价；折扣口径见[价格页](https://router.one/zh/pricing)。
- 用 [Codex 与 Responses API 指南](https://router.one/zh/codex-responses-api)把 Codex CLI 指向一个 GPT id，或按 [Claude Code 国内接入](https://router.one/zh/claude-code-china)把 Claude Code 指向一个 Claude id。

## 相关页面

- 本页规范地址：https://router.one/zh/blog/new-llm-models-september-2026
- LLM API 网关与路由：https://router.one/zh/llm-api-gateway
- 全部博客文章：https://router.one/zh/blog
- 模型与每模型 token 价格：https://router.one/zh/models （markdown：https://router.one/zh/models.md ）
- 定价：https://router.one/zh/pricing
- API 文档（markdown）：https://router.one/zh/docs.md
- 公司事实（markdown）：https://router.one/zh/facts/company.md
