跳到主要内容
Router One
返回博客

GPT-6 Sol API 接入指南:端点、272K 价格阶梯与国内调用

发布作者Router One 团队方法说明

GPT-6 Sol 已经在 Router One 目录里上架,目录 id 是 openai/gpt-6-sol(2026-09-23 观察):1,050,000 token 上下文窗口,文本与图像输入,支持工具调用,在 POST /v1/chat/completions 上服务,并在 POST /v1/responses 上原生服务——后者正是 Codex CLI 使用的协议。国内开发者不需要海外账号、不需要 VPN:把 OpenAI 兼容 SDK 或客户端的 base URL 换成 https://api.router.one/v1,用 Router One 的 Key 发 "model": "openai/gpt-6-sol",请求就会像目录里其他模型一样被路由、计费并记入日志;实时单价看模型页

本文讲清五件事:目录对这个 id 公开了什么、两条价格线怎么算、订阅套餐是否覆盖、两个端点上的第一个请求怎么发,以及从 GPT-6 Astra 或 GPT-5.6 Sol 切过来时有哪些变化。文中的目录信息都注明了观察日期,发起新请求前以实时目录为准。

GPT-6 Sol 速览

项目目录所列(2026-09-23)
目录 idopenai/gpt-6-sol
上下文窗口1,050,000 token
最大输出128,000 token
输入 / 输出文本、图像输入,文本输出
能力标签chat、streaming、tool calling、vision
价格线两条:标准价格线,以及单次输入严格超过 272,000 token 时适用的整单价格线
端点POST /v1/chat/completions,以及原生的 POST /v1/responses
不在此端点服务POST /v1/messages(只服务 Claude 系列与 DeepSeek id)

OpenAI 官方的 GPT-6 Sol 模型页补充了目录里没有的信息:它把这个模型描述为 "built to power complex coding and agentic workflows"(面向复杂编码与 Agent 工作流),知识截止日期为 2026 年 4 月 20 日,1,050,000 token 窗口内最多输入 922,000 token;reasoning.effort 可取 nonelowmedium(默认)、highxhighmax。以上是厂商的说法;Router One 负责的是目录条目本身,以及网关如何路由和计费。

在 Router One 的 GPT 阵容里处在什么位置

2026-09-23 目录共 62 个 id。默认渠道的 GPT 对话 id 有 GPT-6 Astra、GPT-6 Sol、GPT-5.6 Sol、GPT-5.6 Terra 与 GPT-5.5;Codex CLI 审查线专用的 codex-auto-review 单独列出。这五个 id 上下文窗口都是 1,050,000 token,端点系列相同;除 GPT-5.5(目录只列文本输入)外,其余四个都支持图像输入,长上下文门槛也都是 272,000 token。真正的差别在各自模型页上的单价,以及它们在你自己的提示词上表现如何——本文不做排名。

三个对比页用实时目录把规格和单价并排渲染出来:

截至 2026-09-23 有两样东西不在目录里:GPT-6 Luna,以及 GPT-6 Sol 的渠道版。Azure 渠道列有 azure/gpt-6-astra,但没有 azure/gpt-6-sol;渠道前缀改变了什么,见渠道模型 id 指南。id 会上会下,写死之前先到模型目录确认。

两条价格线怎么算

模型页上有两行单价,适用哪一行由单次请求的输入 token 总数决定。输入恰好 272,000 token 时仍按标准线;严格超过之后,整次请求——包括输出——都按长上下文线计费,而不是只对超出门槛的部分加价;月度用量不参与判断。OpenAI 模型页对其官方牌价写的是同一个 272K 门槛、同样按整次请求计的规则,Router One 的阶梯与之对齐。

这条线比 1,050,000 的窗口更值得留意。Agent 循环每一步都会把指令、对话和此前所有工具结果重新发一遍,输入随轮次增长;一次长时间的编码会话,离窗口上限还远,就可能已经越过 272,000。想留在线下,就在接近之前压缩或裁剪历史,并在每次响应的 usage 里看当前会话走到了哪里。

模型页还列有缓存输入相关的价格行。怎么从 usage 里读缓存计数、避免把输入算两遍,见 Prompt 缓存指南;阶梯规则的完整说明在计价方法成本计算器会按请求套用它。推理输出按模型公示的输出单价计费,没有单独的推理价格行(价格事实页)。

订阅套餐覆盖 GPT-6 Sol 吗?

截至 2026-09-23 的套餐接口:Pro、Max、Ultra 的任何档位都没有列出 gpt-6-sol,所以不论是否持有套餐,GPT-6 Sol 的调用都按 token 从钱包余额扣费,单价以模型页公示为准。对照来看,GPT-5.5 与 GPT-5.6 Sol 在三个套餐的 「高级模型」档,GPT-6 Astra 在只有 Max 与 Ultra 才有的 「旗舰模型」档。切换前值得先确认这一点:把一个 Codex 会话从 GPT-5.6 Sol 换成 GPT-6 Sol,计费就从套餐配额变成了钱包扣费。套餐的模型列表会调整,实时列表以价格页为准。

发出第一个请求

  1. 创建 Key。 Dashboard → API Keys → New key,Key 形如 sk-rk-...。试用阶段给这把 Key 设一个 maxSpend 消费上限,失控的循环会停在你定的数字上(按 Key 成本追踪)。
  2. 设置 base URL:在任意 OpenAI 兼容 SDK 或客户端里填 https://api.router.one/v1
  3. 任选一个端点调用。

Chat Completions:

curl https://api.router.one/v1/chat/completions \
  -H "Authorization: Bearer sk-your-api-key" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "openai/gpt-6-sol",
    "messages": [{"role": "user", "content": "用三句话说明整单价格阶梯对 Agent 循环的影响。"}]
  }'

Responses,显式设置推理强度(厂商默认为 medium):

curl https://api.router.one/v1/responses \
  -H "Authorization: Bearer sk-your-api-key" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "openai/gpt-6-sol",
    "reasoning": {"effort": "medium"},
    "input": "用三句话说明整单价格阶梯对 Agent 循环的影响。"
  }'

用 OpenAI Python SDK 调用,只需要改 base_url 和 Key:

from openai import OpenAI

client = OpenAI(
    base_url="https://api.router.one/v1",
    api_key="sk-your-api-key",
)

response = client.responses.create(
    model="openai/gpt-6-sol",
    reasoning={"effort": "medium"},
    input="用三句话说明整单价格阶梯对 Agent 循环的影响。",
)
print(response.output_text)
print(response.usage)

两个端点都支持 stream: true流式输出指南)和工具调用(工具调用指南)。把这个 id 发到 POST /v1/messages,会在调用任何模型之前被拒绝,返回 HTTP 400 invalid_request_error,错误信息里会写明能服务它的路径。请求格式的通用说明见 OpenAI 兼容 API,各系列的端点规则见 API 兼容性事实页

  1. 看 Trace。 Dashboard → Logs 里每次调用都带模型、输入输出 token、费用、延迟和状态。可重试的上游故障由同一模型多条候选线路之间的自动故障转移消化(每请求可观测)。

Codex CLI:改一行

如果你的 Codex CLI 已经接在 Router One 上,只需在 ~/.codex/config.toml 里把 model 改成 "gpt-6-sol"——这是裸名,网关会解析为 openai/gpt-6-sol——provider 上的 wire_api = "responses" 保持不变。从零开始配置,完整的 config.toml 见 Codex CLI 国内使用;为什么只支持 Chat Completions 的中转会让 Codex 报 404,见 Codex 与 Responses API;没有 ChatGPT Plus 也能用 Codex,见这篇。Cursor、Cline、OpenCode 等编程工具逐个怎么配,见 GPT-6 Sol 接入 Codex CLI、Cursor、Cline 与 OpenCode

从 GPT-6 Astra 或 GPT-5.6 Sol 切过来

从请求层面看,切换只是改一个 model 字符串:Key、base URL、端点、1,050,000 token 窗口和 272,000 token 门槛都不变。会变的是:

  • 单价。 每个 id 在自己的模型页上有自己的价格线,上面的对比页用实时目录把它们并排列出。
  • 套餐覆盖。 截至 2026-09-23,GPT-6 Astra(Max 与 Ultra)和 GPT-5.6 Sol(三个套餐)在套餐覆盖范围内,GPT-6 Sol 不在。
  • 在你的提示词上的表现。 新模型的回答方式会不同。切生产链路之前,用你自己的提示词集跑一遍,而不是只看别人挑的榜单。

稳妥的做法:另建一把设了 maxSpend 上限的 Key,用它把一部分真实流量发到 openai/gpt-6-sol,再在 Dashboard → Logs 里按模型筛选,逐个任务对比它和你现在用的 id 在费用、延迟和状态上的差异。故障转移只在同一模型的候选线路之间重试,不会把 GPT-6 Sol 换成别的模型,所以对比结果是干净的。

国内怎么用

中国大陆可直连 api.router.one,无需 VPN,Key 和 base URL 与海外完全一致。充值可用支付宝或银行卡在同一个托管收银台完成,也支持 6 条链上的 USDT/USDC(Tron、BSC、以太坊、Polygon、Base、Arbitrum),无需美国信用卡。部分模型最低官方价 1 折(最高省 90%);具体某个 id 的单价,看 GPT API 接入页和对应模型页。

常见问题

GPT-6 Sol 在 Router One 上的模型 id 是什么? openai/gpt-6-sol。自 2026-09-23 起,裸名 gpt-6-sol 也会解析到同一个模型,在 Codex CLI 这类只填裸模型名的客户端里更方便。实时单价和端点列表见模型页 /models/gpt-6-sol。

Claude Code 能用 GPT-6 Sol 吗? 不能。Claude Code 向 /v1/messages 发送 Anthropic Messages 请求,这个端点只服务 Claude 系列与 DeepSeek id;GPT id 发过去会在调用任何模型之前返回 HTTP 400 invalid_request_error。要用 GPT-6 Sol,可以用走 Responses 协议的 Codex CLI,或任何向 https://api.router.one/v1 发 Chat Completions 的客户端。

272K 阶梯只对超出门槛的 token 生效吗? 不是。适用哪条价格线由单次请求的输入 token 总数决定:恰好 272,000 按标准线;严格超过后,整次请求(含输出)都按长上下文线计费。月度用量不影响阶梯。

Router One 的订阅套餐包含 GPT-6 Sol 吗? 截至 2026-09-23 的套餐接口不包含:Pro、Max、Ultra 的任何档位都没有列出它,调用按 token 从钱包余额扣费。GPT-5.5 与 GPT-5.6 Sol 在三个套餐的 「高级模型」档,GPT-6 Astra 在 Max 与 Ultra 的 「旗舰模型」档。当前的套餐模型列表以价格页为准。

能通过 Router One 调用 GPT-6 Luna 吗? 截至 2026-09-23 的目录没有列出 GPT-6 Luna。实时目录 /models 是唯一的依据,本文不对之后是否上架做任何承诺。

有 Azure 渠道版的 GPT-6 Sol 吗? 截至 2026-09-23 没有。Azure 渠道列有 azure/gpt-6-astra,但没有 azure/gpt-6-sol。渠道 id 是同一基础模型的独立定价产品,单价与路由池都是渠道自己的,规则见渠道模型 id 指南。

经 Router One 调用 GPT-6 Sol 多少钱? 本文不印每 token 单价,因为它会过时。模型页实时显示两条价格线,对比页会渲染它与 GPT-6 Astra、GPT-5.6 Sol、Claude Sonnet 5 之间的价差。部分模型最低官方价 1 折(最高省 90%)。

下一步

相关权威页面

这篇文章归入「Codex CLI 中国」主题,以下页面作为商业页、配置文档、证据页和信任事实源。

相关阅读