OpenAI 于 2026 年 9 月 3 日发布的 GPT-6 Astra 已于 2026-09-05 在 Router One 目录上架,目录 id 是 openai/gpt-6-astra。它在 POST /v1/responses 上原生服务——这正是 Codex CLI 使用的协议——也在 POST /v1/chat/completions 上服务。国内开发者不需要海外账号、不需要 VPN:把 OpenAI 兼容 SDK 或客户端的 base URL 换成 https://api.router.one/v1,用 Router One 的 Key 发 "model": "openai/gpt-6-astra",请求就会像目录里其他模型一样被路由、计费并记入日志。按 2026-10-03 的套餐接口,GPT-6 Astra 是「旗舰模型」档里唯一的模型,而只有 Router One 的 Max 与 Ultra 套餐带这一档;用 Pro 套餐时,它的调用按 token 从钱包扣费。实时单价看 GPT-6 Astra 模型页。
本文依次讲清:目录对这个 id 公开了什么,OpenAI 怎么把它与 GPT-6.1 Sol、GPT-6 Sol 区分,哪些套餐覆盖它、请求怎么计次,OpenAI 的请求规则对代码有什么影响,Codex CLI 里怎么用,以及两个端点上的第一个请求怎么发。文中的目录与套餐信息都注明了观察日期,发起新请求前以实时目录为准。
GPT-6 Astra 速览
| 项目 | 目录所列(2026-10-03) |
|---|---|
| 目录 id | openai/gpt-6-astra,2026-09-05 上架 |
| 上下文窗口 | 1,050,000 token |
| 输入 / 输出 | 文本、图像输入,文本输出 |
| 能力标签 | chat、streaming、tool calling、vision |
| 价格线 | 两条:标准价格线,以及单次输入严格超过 272,000 token 时适用的整单价格线 |
| 端点 | 原生的 POST /v1/responses,以及 POST /v1/chat/completions |
| 不提供的端点 | POST /v1/messages(只服务 Claude 系列与 DeepSeek id) |
| 渠道 id | azure/gpt-6-astra——同一基础模型的独立定价产品,不在任何套餐档位 |
| 套餐 | Max 与 Ultra 的「旗舰模型」档(2026-10-03 套餐接口);Pro 按钱包计费 |
OpenAI 官方的 GPT-6 Astra 模型页(2026-10-03 核对)补充了目录里没有的信息:它称 GPT-6 Astra 为 "our most capable model for the most demanding work"(能力最强、面向最高难度工作的模型),在 1,050,000 token 窗口内最多输入 922,000 token、最多输出 128,000 token,知识截止日期为 2026 年 4 月 30 日;reasoning.effort 可取 low、medium、high、xhigh 与 max。模型页没有标出默认强度,OpenAI 的 reasoning 指南(2026-10-03 核对)写了其他 GPT-6 模型的默认值,却没有写 GPT-6 Astra 的,所以下文每个示例都显式设置推理强度。按 OpenAI 的 GPT-6 指南(2026-10-03 核对),GPT-6 Astra 的工具调用只能走 Responses API;在 Chat Completions 上,它只用于不带工具的请求。以上是厂商的说法;Router One 负责的是目录条目本身,以及网关如何路由和计费。
选 GPT-6 Astra、GPT-6.1 Sol 还是 GPT-6 Sol?
OpenAI 的 GPT-6 指南(2026-10-03 核对)把 GPT-6 Astra 定位为 "highest intelligence"(智能最高的一档),面向 "the most demanding reasoning, coding, and professional work"(最高难度的推理、编码与专业工作),把 GPT-6.1 Sol 定位为 "balanced speed, cost, and intelligence"(速度、成本与智能兼顾)。OpenAI 的模型目录还称 GPT-6 Astra 是它面向复杂推理与编码的旗舰模型——这是 OpenAI 对自家产品线的说法,与 Router One 套餐里的「旗舰模型」档不是一回事。OpenAI 的发布文章(2026 年 9 月 3 日)公布:在 OSWorld 2.0 的延迟模拟中,GPT-6 Astra 的 computer use 表现高于 GPT-5.6 Sol,每个任务的耗时少约 47%;GPT-6.1 Sol 的发布文章(2026 年 9 月 29 日)公布:在 DeepSWE v1.1 上,GPT-6.1 Sol 与 GPT-6 Astra 持平。这些是 OpenAI 的结果,不是 Router One 的测量;把一类任务迁过去之前,先用你自己的提示词跑一遍。
Router One 这一侧,选择时还要看三点:
- 套餐额度还是钱包。 按 2026-10-03 的套餐接口,GPT-6 Astra 计入 Max 与 Ultra 的「旗舰模型」额度,GPT-6.1 Sol 与 GPT-6 Sol 都不在任何套餐档位、从钱包扣费;用 Pro 套餐时,三者都从钱包扣费。GPT-5.6 Sol 与 GPT-5.5 仍在三个套餐的「高级模型」档。
- 公示单价。 Router One 为每个 id 单独公示单价,切换前请重新核算成本。
- 请求路径相同。 三者都是 GPT 系列 id,都在 Codex CLI 使用的
/v1/responses上原生服务。
四个对比页用实时目录把规格和单价并排渲染出来:
- GPT-6.1 Sol vs GPT-6 Astra——用 Max / Ultra 的「旗舰模型」额度跑 Astra,还是按钱包计费跑 OpenAI 模型页称接近 Astra 表现的 GPT-6.1 Sol。
- GPT-6 Sol vs GPT-6 Astra——上一代 Sol 模型与 Astra 的对比。
- GPT-6 Astra vs GPT-5.6 Sol——Astra 与 Codex 一键安装默认写入的 GPT-5.6 Sol 之间的代际对比。
- Claude Opus 5.5 vs GPT-6 Astra——跨厂商怎么选;两者的端点与套餐状态都不同。
哪些套餐覆盖 GPT-6 Astra?
按 2026-10-03 的套餐接口,GPT-6 Astra 是「旗舰模型」档里唯一的模型,只有 Router One 的 Max 与 Ultra 套餐带这一档:Max 每个 30 天周期 150 次旗舰请求,Ultra 450 次。用 Max 或 Ultra 时,每个 GPT-6 Astra 请求从旗舰模型额度扣 1 次——单次总输入严格超过 272,000 token 扣 2 次、超过 512,000 扣 4 次;输入计数含缓存输入,只计一次,输出不计入。本周期额度用完后,后续调用按公示单价从钱包扣费。用 Pro 套餐,以及在任何套餐下调用单独定价的渠道 id azure/gpt-6-astra,都从钱包扣费。套餐的模型列表与额度会调整,实时数据以价格页为准。
请求要注意什么
从其他 GPT id 换到 GPT-6 Astra,Key、base URL 和端点都不变。下面三条请求规则来自 OpenAI 的 GPT-6 指南(迁移速查部分,2026-10-03 核对):
- 推理强度。 GPT-6 Astra 接受
low、medium、high、xhigh与max,不接受none。OpenAI 的 reasoning 指南(2026-10-03 核对)写明设为none会返回 HTTP 400,GPT-6 指南建议改用low;原来用minimal的,OpenAI 建议从low起步并对比效果。Responses 上用reasoning.effort设置,Chat Completions 上用reasoning_effort。 - 工具调用。 GPT-6 Astra 的工具调用只能走 Responses API。在 Chat Completions 上发送工具的代码,要改走
/v1/responses(Router One 在这个端点上原生服务 GPT 系列)。 - 采样参数。 去掉
temperature、top_p和top_logprobs,Chat Completions 上还要去掉logprobs;Responses 上要把message.output_text.logprobs从include里拿掉。OpenAI API 更新日志里 GPT-6 Astra 的条目(2026 年 9 月 3 日)也写明:不支持自定义temperature与top_p,也不支持 log probabilities。
费用怎么算
模型页上有两行单价,适用哪一行由单次请求的输入 token 总数决定。输入恰好 272,000 token 时仍按标准线;严格超过之后,整次请求——包括输出——都按长上下文线计费,而不是只对超出门槛的部分加价;月度用量不参与判断。OpenAI 模型页对其官方牌价写的是同一个 272K 门槛、同样按整次请求计的规则,Router One 的长上下文价格线与之对齐。
推理输出按模型公示的输出单价计费,没有单独的推理价格行(价格事实页),所以推理强度既是质量旋钮,也是成本旋钮。模型页还列有缓存输入的价格行;怎么从 usage 里读缓存计数、避免把输入算两遍,见 Prompt 缓存指南;长上下文计价规则的完整说明在计价方法,成本计算器会按请求套用它。用 Max 与 Ultra 时,旗舰额度之内的调用按上文的规则扣套餐次数,不从钱包扣费。
本文不印每 token 单价,因为它会过时。实时单价看 GPT-6 Astra 模型页,上面的对比页会渲染它与几个 Sol 模型、Claude Opus 5.5 之间的价差。
Codex CLI:一行 model 配置
要在 Codex CLI 里用 GPT-6 Astra,在 ~/.codex/config.toml 的 [model_providers] 表之前写一行顶层 model,provider 上的 wire_api = "responses" 保持不变:
# ~/.codex/config.toml
model = "openai/gpt-6-astra"
model_provider = "router"
model_reasoning_effort = "low"
[model_providers.router]
name = "router"
base_url = "https://api.router.one/v1"
env_key = "ROUTER_ONE_API_KEY"
wire_api = "responses"
按 Codex 的发布说明(2026-10-03 核对),Codex 0.153.1 及以后的版本可以配置 GPT-6 Astra;切换前先用 npm install -g @openai/codex 升级。示例用的是目录 id:按 openai/codex 源码(rust-v0.160.0,2026-10-03 核对),Codex 会把 openai/gpt-6-astra 这类带命名空间的名字匹配到内置模型列表里的 gpt-6-astra 条目,因此它对 GPT-6 Astra 的设置同样生效。按这份内置列表,Codex 给 GPT-6 Astra 的默认推理强度是 low(Codex 模型文档里叫 Light,文档也建议从它起步),并默认按 272,000 token 的上下文窗口使用这个模型。示例之所以显式写出推理强度,是因为一键安装写入的 config.toml 带有 model_reasoning_effort = "high"。
这套配置面向 Max 与 Ultra:Codex 发出的每个 GPT-6 Astra 请求都从旗舰模型额度扣次——输入超过 272,000 token 扣 2 次、超过 512,000 扣 4 次。一个 Agent 会话会发出很多请求,一个周期的旗舰额度可能很快用完;用完之后的调用从钱包扣费,这时请改回 model = "gpt-5.6-sol",它在三个套餐的「高级模型」档。Pro 套餐没有旗舰额度,用 Pro 的请保持一键安装写入的 model = "gpt-5.6-sol"。完整配置见 Codex CLI 国内使用;为什么不支持 Responses 协议的中转接不了 Codex,见 Codex 与 Responses API。
发出第一个请求
- 创建 Key。 控制台 → API 密钥 → 创建密钥,Key 形如
sk-...。试用阶段给这把 Key 设一个maxSpend消费上限:花费不会超过这个上限,其他 Key 照常可用(按 Key 成本追踪)。 - 保证钱包有余额。 以下三种情况,GPT-6 Astra 的调用都从钱包扣费:用 Pro 套餐时;用 Max 或 Ultra、本周期旗舰模型额度已用完时;调用渠道 id
azure/gpt-6-astra时。充值在控制台 → 充值。 - 设置 base URL:在任意 OpenAI 兼容 SDK 或客户端里填
https://api.router.one/v1。 - 调用模型。 下面的示例都用目录 id
openai/gpt-6-astra,并显式设置推理强度与输出上限。
Responses(原生路径),显式设置推理强度:
curl https://api.router.one/v1/responses \
-H "Authorization: Bearer sk-your-api-key" \
-H "Content-Type: application/json" \
-d '{
"model": "openai/gpt-6-astra",
"reasoning": {"effort": "medium"},
"max_output_tokens": 25000,
"input": "列出整单价格阶梯对 Agent 循环的三个风险。"
}'
工具调用走这个端点。Responses 格式的函数工具示例:
curl https://api.router.one/v1/responses \
-H "Authorization: Bearer sk-your-api-key" \
-H "Content-Type: application/json" \
-d '{
"model": "openai/gpt-6-astra",
"reasoning": {"effort": "low"},
"max_output_tokens": 25000,
"tools": [{
"type": "function",
"name": "get_order_status",
"description": "Look up the status of an order by its id.",
"parameters": {
"type": "object",
"properties": {"order_id": {"type": "string"}},
"required": ["order_id"]
}
}],
"input": "订单 8812 现在到哪了?"
}'
输出里出现 function_call 项时,执行这个函数,再把结果作为带同一个 call_id 的 function_call_output 项发回去;OpenAI 的 reasoning 指南建议把这一轮返回的推理项也一并传回。
Chat Completions,给发这种请求的客户端用——按 OpenAI GPT-6 指南的要求不带工具:
curl https://api.router.one/v1/chat/completions \
-H "Authorization: Bearer sk-your-api-key" \
-H "Content-Type: application/json" \
-d '{
"model": "openai/gpt-6-astra",
"reasoning_effort": "medium",
"max_completion_tokens": 25000,
"messages": [{"role": "user", "content": "列出整单价格阶梯对 Agent 循环的三个风险。"}]
}'
用 OpenAI Python SDK 发同样的 Responses 请求,只需要改 base_url 和 Key:
from openai import OpenAI
client = OpenAI(
base_url="https://api.router.one/v1",
api_key="sk-your-api-key",
)
response = client.responses.create(
model="openai/gpt-6-astra",
reasoning={"effort": "medium"},
max_output_tokens=25000,
input="列出整单价格阶梯对 Agent 循环的三个风险。",
)
print(response.status, response.output_text)
print(response.usage)
两个端点通用的几条规则:
- 每个请求都设置输出上限。 推理 token 计入输出上限;OpenAI 建议起步时为推理与输出预留至少 25,000 token(reasoning 指南,2026-10-03 核对)。按同一份指南,达到上限的响应会以
status: "incomplete"返回,可能连可见文字都还没有输出。在 Router One 的 Chat Completions 上,max_tokens与max_completion_tokens都可以设定这个上限(两者同时传入时以max_completion_tokens为准);Responses API 上用max_output_tokens。 - 设置推理强度。 OpenAI 没有写明 GPT-6 Astra 的默认推理强度,所以每个请求都在
low到max之间指定一个。 - 不传采样参数。 不要传
temperature、top_p、top_logprobs或logprobs,原因见上文。 - 长任务用流式。
stream: true让输出边生成边返回,两个端点都可以用(流式输出指南)。 - 不要发到
/v1/messages。 把这个 id 发到那里,会在调用任何模型之前返回 HTTP 400,错误信息会写明该模型必须通过 /v1/chat/completions 调用。各系列的端点规则见 API 兼容性事实页。
- 看 Trace。 控制台 → 日志里每次调用都带模型、输入输出 token、费用、延迟和状态(每请求可观测)。可重试的上游故障由同一模型多条候选线路之间的自动故障转移消化;GPT-6 Astra 的请求绝不会被换成别的模型来回答。
其他编程工具
编程 agent 几乎每一轮都会带上工具,而按 OpenAI 的 GPT-6 指南(2026-10-03 核对),GPT-6 Astra 的工具调用只能走 Responses API,所以用它跑 agent 任务需要发 Responses 请求的客户端。把工具指向它之前,先确认那个工具发的是哪种协议:各工具的请求路径见 GPT-6 Sol 接入 Codex CLI、Cursor、Cline 与 OpenCode 里的工具表。Claude Code 调不了 GPT-6 Astra:它发的是 Anthropic Messages 请求,而 /v1/messages 只服务 Claude 系列与 DeepSeek id。
国内怎么用
中国大陆可直连 api.router.one,无需 VPN,Key 和 base URL 与海外完全一致。充值可用支付宝或银行卡在同一个托管收银台完成,也支持 6 条链上的 USDT/USDC(Tron、BSC、以太坊、Polygon、Base、Arbitrum),无需美国信用卡。部分模型最低官方价 1 折(最高省 90%);具体某个 id 的单价,看 GPT API 接入页和对应模型页。Codex CLI 的国内配置见 Codex CLI 国内使用。
常见问题
Router One 上 GPT-6 Astra 的模型 ID 是什么? openai/gpt-6-astra,即目录 id——两个端点和 Codex CLI 里都用它。azure/gpt-6-astra 是同一基础模型的另一个渠道 id,有自己的单价,任何套餐档位都不覆盖它。
Router One 的哪些套餐包含 GPT-6 Astra? Max 与 Ultra,通过「旗舰模型」档:按 2026-10-03 的套餐接口,GPT-6 Astra 是「旗舰模型」档里唯一的模型,只有这两个套餐带这一档。用 Pro 套餐时,它的调用按 token 从钱包扣费。各套餐的实时额度见价格页。
GPT-6 Astra 的请求怎么从旗舰额度里扣? 每次调用扣 1 次,单次总输入严格超过 272,000 token 扣 2 次、超过 512,000 扣 4 次。缓存输入作为输入的一部分只计一次,输出不计入。超出本周期额度的调用按公示单价从钱包扣费。
GPT-6 Astra 能在 Chat Completions 上做工具调用吗? 按 OpenAI 的说法不能:它的 GPT-6 指南(2026-10-03 核对)写明 GPT-6 Astra 支持 Chat Completions,但工具调用需要 Responses API。带工具的请求请发到 /v1/responses(Router One 在这个端点上原生服务 GPT 系列),Chat Completions 留给不带工具的请求。
GPT-6 Astra 接受哪些推理强度? 按 OpenAI 的模型页(2026-10-03 核对):low、medium、high、xhigh 与 max。OpenAI 的 reasoning 指南写明设为 none 会返回 HTTP 400,GPT-6 指南建议改用 low。OpenAI 没有写明 GPT-6 Astra 的 API 默认强度,所以每个请求都要设置;在 Codex 里,内置的默认值是 low。
Codex CLI 怎么用 GPT-6 Astra? 先升级 Codex——按发布说明(2026-10-03 核对),0.153.1 及以后的版本可以配置 GPT-6 Astra——再在 config.toml 的 [model_providers] 表之前写一行顶层 model = "openai/gpt-6-astra",provider 上保持 wire_api = "responses"。用 Max 或 Ultra 时,Codex 发出的每个 GPT-6 Astra 请求都从旗舰模型额度扣次,额度用完后请改回 model = "gpt-5.6-sol";Pro 套餐没有旗舰额度,用 Pro 的请保持一键安装写入的 model = "gpt-5.6-sol"(「高级模型」档)。
272K 价格线对 GPT-6 Astra 适用吗?Codex CLI 里也一样吗? 适用。它的模型页有两行单价:输入恰好 272,000 token 时按标准线;严格超过后,整次请求(含输出)都按长上下文线计费。Router One 对 Codex CLI 的请求与其他 API 请求一样计费:用钱包时按 GPT-6 Astra 的公示单价计费,包括长上下文线;用 Max 或 Ultra 时,输入超过 272,000 token 的请求扣 2 次旗舰额度,超过 512,000 扣 4 次。
选 GPT-6 Astra 还是 GPT-6.1 Sol? OpenAI 把 GPT-6 Astra 定位为智能最高的一档,把 GPT-6.1 Sol 定位为速度、成本与智能兼顾(GPT-6 指南,2026-10-03 核对)。在 Router One 上,两者的套餐状态不同:按 2026-10-03 的套餐接口,GPT-6 Astra 计入 Max 与 Ultra 的「旗舰模型」额度,GPT-6.1 Sol 不在任何套餐档位、从钱包扣费。GPT-6.1 Sol vs GPT-6 Astra 对比页会并排渲染实时单价。
Claude Code 能调用 GPT-6 Astra 吗? 不能。Claude Code 向 /v1/messages 发送 Anthropic Messages 请求,这个端点只服务 Claude 系列与 DeepSeek id;GPT id 发过去会在调用任何模型之前返回 HTTP 400。
调用 GPT-6 Astra 需要 ChatGPT 订阅吗? 不需要。Router One 按你的 Router One 钱包或套餐对 API 调用计费。OpenAI 的发布文章(2026 年 9 月 3 日)写明 GPT-6 Astra 分批向 ChatGPT 订阅用户与 OpenAI API 开放;ChatGPT 套餐与经 Router One 发出的 API 调用无关。
没有 GPT-6.1 Astra 吗? 按 OpenAI 的模型目录(2026-10-03 核对),没有 GPT-6.1 Astra 条目;它的 GPT-6 指南把 GPT-6.1 Sol 与 GPT-6 Astra 并列。Router One 目录里有 GPT-6 Astra(openai/gpt-6-astra)和 GPT-6.1 Sol(openai/gpt-6.1-sol),以实时目录 /models 为准。
经 Router One 调用 GPT-6 Astra 多少钱? 用钱包时按 token 计费,单价以 GPT-6 Astra 模型页公示为准:两条价格线,推理按输出计费。用 Max 与 Ultra 时,旗舰额度之内的调用改为扣套餐次数。本文不印每 token 单价,因为它会过时;对比页会实时渲染它与 GPT-6.1 Sol、GPT-6 Sol、GPT-5.6 Sol、Claude Opus 5.5 之间的价差。
下一步
- 打开 GPT-6 Astra 模型页,查看实时单价、两条价格线和端点列表。
- 与 GPT-6.1 Sol、GPT-6 Sol、GPT-5.6 Sol、Claude Opus 5.5、Claude Opus 5、Claude Fable 5 或 Grok 4.7 对比。
- 想改用 Sol 模型,见 GPT-6.1 Sol API 接入指南与 GPT-6 Sol API 接入指南。
- 配置 Codex CLI:Codex CLI 国内使用与 Codex 与 Responses API。
- 各套餐覆盖哪些模型,见价格页。
- 9 月目录的其他变化,见 2026 年 9 月新模型指南。