跳到主要内容
Router One
返回博客

Router One 更新日志:模型上新与价格调整

发布修订作者Router One 团队方法说明

本页记录 Router One 平台上线以来的主要功能、改进与里程碑。我们会在每次新版本发布后同步更新这里。


2026 年 8 月

Grok 4.20 下架,对应对比页退役(8 月 26 日)

Grok 4.20 非推理档已不在目录,Grok API 页的阵容改为 grok-4.6 与 grok-4.5,Grok 4.20 vs DeepSeek V4 Flash 对比页按 Kimi 的先例退役。模型对比每页标题下新增结论段、规格表旁新增「价格读取日期」、相关对比按实时目录过滤,并补上系列落地页、成本计算器定价方法的链接。

Nano Banana 2 API 指南与 API 参考文档刷新(8 月 25 日)

新增 Nano Banana 2 API 指南,把 gemini-3.1-flash-image-preview 讲完整:POST /v1/images/generations 文生图、POST /v1/images/edits 带参考图改图、按张固定单价,以及和 Nano Banana Pro(gemini-3-pro-image-preview)怎么选;生图 API 页的两张 Gemini 模型卡也标上了这两个名字。API 参考文档按网关实际行为对齐:补上 GET /v1/models,错误体展示网关真实返回的大写下划线 coderequest_id,429 行改为读 Retry-After 并点名三种配额 code,新增响应头里的限流字段一节,/v1/messages 写明对 Claude 与 DeepSeek V4 之外模型返回的 Anthropic 信封格式 400,生图与视频示例改用目录里的模型 ID 和固定成片规格。Codex / Responses API 页新增说明 Codex 跑 /review 时发送的 codex-auto-review 模型 ID。

视频页重写、对比页新增四对、生图阵容补上 Gemini 3.1 Flash Image(8 月 24 日)

视频生成页改为以目录里真实在售的视频模型开篇,逐个写明固定成片规格,并直接说明 Veo 与 Grok Video 当前不在目录。生图 API 页在 gpt-image-2、Gemini 3 Pro Image、豆包 Seedream 与两个 Grok Imagine 条目之外补上 Gemini 3.1 Flash Image,并写清参考图编辑走 POST /v1/images/edits错误码页新增开头的 400 行,覆盖「模型用错端点」这一类。模型对比新增四对:DeepSeek V4 Pro vs DeepSeek V4 FlashGemini 3.1 Pro vs GPT-5.6 Sol、Grok 4.20 vs DeepSeek V4 Flash(此后已退役——Grok 4.20 于 2026-08-26 下架,该对比页随之撤下)、MiniMax M2.7 vs GLM-5.2;同时下线三对 Kimi 对比——Kimi 已不在目录。

六个视频模型上线,时长与分辨率按模型锁死(8 月 23 日)

viduq3-turbo(5 秒 720p)、viduq3-turbo-540p(4 秒 540p)、pixverse-video(5 秒 540p)、MiniMax-Hailuo-2.3MiniMax-Hailuo-02(6 秒 768P)、wan2.6-i2v(5 秒 720P,图生视频,必须且只能传一张 image_url)都在 POST /v1/videos/generations 上服务:提交任务、按 ID 轮询、下载成片。每个模型只出一种固定的时长×分辨率组合,请求体里写 durationsize 也不会改变成片;每条按一个固定单价计费,并记录在该请求的成本 trace 里。实时单价见模型页 video 类别,阵容与调用方式见视频生成页

Gemini 生图模型:文生图与参考图编辑(8 月 23 日)

目录里的两个 Gemini 生图条目——gemini-3-pro-image-previewgemini-3.1-flash-image-preview——在网关生图链路修复后可在 POST /v1/images/generations 正常出图;两者都支持图片输入,因此也可以走 POST /v1/images/edits 传参考图(multipart/form-data,文件放在 image 字段)。两者与生图阵容其余模型一样按张计一个固定单价。详见生图 API 页

Claude 模型 ID 发到 /v1/responses 返回 400(8 月 23 日)

把 Claude 家族的模型 ID 发到 /v1/responses,现在会在调用任何模型之前被拒绝,返回 400 invalid_request_error——model '<id>' must be called via /v1/messages or /v1/chat/completions——不消耗 token,报错消息直接给出改法。/v1/responses 原生服务 GPT 与 DeepSeek V4 模型;Claude 系列走 /v1/messages/v1/chat/completions。每个模型详情页列出它支持的端点,完整的端点×系列对照见 API 兼容性事实页

报告了 usage 的空回复按 200 返回(8 月 23 日)

一次没有正文、没有工具调用、也没有拒答,但报告了 token usage 的回复,是一次已完成的响应而不是故障:网关原样按 HTTP 200 返回,不重试也不切换候选,结算依据是该响应报告的 usage。不要自动重试——先读回复里的 finish_reasonrefusalusage,循环重试只是为同一份沉默再付一次钱。完全没有 usage 的空响应仍按上游故障处理:网关换下一个候选,都不成功时返回 502。排查说明见错误码页

结构化输出指南、Responses 端点矩阵、Gemini 3.7 Flash 对比页、API 兼容性事实页,再加五页 Markdown 镜像(8 月 22 日)

新增 LLM 结构化输出指南,讲清 OpenAI 兼容端点上的 response_format:网关在调用上游之前校验什么、为什么 schema 的执行在模型侧。Codex / Responses API 页 新增端点矩阵,列出 Responses 请求里哪些特性接受、哪些拒绝。模型对比新增两对 Gemini 3.7 Flash:Gemini 3.7 Flash vs GPT-5.4 miniGemini 3.7 Flash vs Gemini 3.6 Flash。机器可读的 API 兼容性事实页 写明每个端点家族服务哪些模型系列。另外五个信任类页面——安全数据留存路由方法论定价方法论国内延迟基准——也有了 .md 镜像,AI 爬虫读到的内容与渲染页面完全一致。

Chat Completions 支持 json_schema 结构化输出透传(8 月 20 日)

response_formattype: "json_schema" 的请求现在由网关校验后原样转发给模型。json_schema 块缺 nameschema 时,会在调用任何上游之前返回 400 invalid_request_error——response_format.json_schema.name is required / response_format.json_schema.schema is required——格式错误的请求不消耗 token。json_object 模式此前已经透传。schema 的执行在模型侧:模型支持时输出才受约束,所以客户端仍要解析并校验。当某条模型线路拒绝含 $defs$ref 的 schema 时,网关把这次拒绝当作该候选线路自身的 400,转到同一模型的下一个候选。请求形态和细节见结构化输出指南

Responses API 开放托管工具、文件输入、服务等级与服务端上下文(8 月 19 日)

/v1/responses 上,使用 custom tools、previous_response_idconversationprompt、托管工具(file_searchcode_interpretercomputer_usemcpweb_search)、file_id / file_url 输入分片以及任意 service_tier 取值的请求,现在在模型详情页列有 POST /v1/responses 的模型上均被接受,按该模型的标准费率计费。function tools 此前已支持。仍会返回 400 invalid_request_error 的:image_generation 工具与 image_generation_call 条目(请改用 /v1/images/generations),以及 background: true。完整矩阵见 Codex / Responses API 页

模型目录新增 Gemini 3.7 Flash(8 月 17 日)

google/gemini-3.7-flash 上架,支持对话、流式、工具调用与视觉,上下文窗口 1M token。实时单价见其模型页

新模型潮承接:对比页新增五对、八月新模型指南、n8n 与沉浸式翻译接入指南、SLA 页 Markdown 镜像(8 月 16 日)

2026 年 8 月新模型指南是目录当前一代的叙事伴读——Claude Opus 5、GPT-5.6 家族、Grok 4.6、Kimi K3(其后已不在目录)与 DeepSeek V4 Flash——附一把 Key 改 route key 直接 A/B 的做法。两篇客户端指南上线:n8n,工作流自动化平台——把它 OpenAI 凭证的 Base URL 指向网关,每一步的模型调用都落进同一本账,受按 Key 的 maxSpend 上限约束;沉浸式翻译,双语对照翻译浏览器扩展,它的自定义 OpenAI 兼容接口要填含 /chat/completions 的完整路径。Grok API 国内接入页的模型列表更新到 Grok 4.6,SLA 页新增面向 AI 爬虫的 Markdown 镜像。模型对比新增五对:Grok 4.6 vs GPT-5.6 SolGrok 4.6 vs GPT-5.6 TerraGrok 4.6 vs Grok 4.5GPT-5.6 Sol vs GPT-5.6 Terra豆包 Seed 2.0 Lite vs DeepSeek V4 Flash——全部从实时目录渲染。

DeepSeek V4 接入 Anthropic 兼容的 /v1/messages 端点(8 月 15 日)

deepseek-v4-prodeepseek-v4-flash 现在可以通过 /v1/messages——Claude Code 使用的 Anthropic 线格式端点——直接调用,Claude Code 用原来调 Claude 系列的同一个 base URL 和 Key 就能指向这两个模型。/v1/chat/completions 仍然服务全部对话模型;每个模型详情页列出它支持的端点。

Zed、Continue、Open WebUI 接入指南与 Grok API 页面,对比页新增三对(8 月 12 日)

客户端接入目录新增三家:ZedContinueOpen WebUI 各自上线配置指南,配置项按当前客户端版本在线核实,而不是照抄旧文档。新增 Grok API 国内接入页,讲清如何经网关调用 Grok 系列模型、国内直连可达。模型对比新增三对:Claude Fable 5 vs Claude Opus 5Claude Fable 5 vs GPT-5.6 SolGrok 4.5 vs GPT-5.5——全部从实时目录渲染,规格和单价不会过期。

Cursor 与 OpenClaw 接入指南(8 月 7 日)

两篇新的配置指南上线:Cursor 讲自定义 base URL 与 Key 的填法,与 CLI 工具共用同一个钱包和请求 trace;OpenClaw 讲如何把 agent 指向 OpenAI 兼容端点。两页均为中英双语。

托管收银台充值可开发票(8 月 4 日)

发票政策统一:任何通过托管收银台(支付宝或银行卡)完成的充值都可以开票——普通按量钱包充值同样可以,不限于企业或订阅账户。稳定币充值属于另一条通道,不在开票范围内。开票请发邮件到 support@router.one 并附上账户 ID。


2026 年 7 月

Claude Code 与 Codex 一键接入,新增快速开始与 FAQ 文档(7 月 24 日)

接入 CLI 不再需要手动改配置文件。一条安装命令即可完成配置:Claude Code 会把网关 base URL 与鉴权 token 写进 ~/.claude/settings.jsonenv 块;Codex CLI 会生成带 env_key~/.codex/config.toml,并把 Key 的 export 追加到 shell 配置文件。脚本覆盖 macOS、Linux 与 Windows PowerShell。文档同步新增两页:快速开始带你在五分钟内跑通两套协议下的第一个请求,常见问题与排障讲清 Base URL 选择与 401/402/429 的排查路径。

支付宝并入托管收银台,充值金额可自由填写(7 月 24 日)

钱包充值统一走同一个托管收银台,可选支付宝或银行卡;金额输入框也从固定档位改为可自由填写。支付宝或银行卡在同一个托管收银台完成充值,也支持 6 条链上的 USDT/USDC(Tron、BSC、以太坊、Polygon、Base、Arbitrum),无需美国信用卡。

生图与视频场景页上线(7 月 18 日)

新增三个承接生成类负载的页面:文生图 API 页 讲 OpenAI 兼容端点背后的文生图模型,Veo 视频 API 页 讲异步视频生成,另有一篇中英双语博客指南讲国内如何调用这两类接口。媒体模型按生成的张/条计价,而不是按 token,每个模型的单价见模型目录

站点语言自动识别(7 月 10 日)

对外站点现在会在首次访问时根据浏览器的 Accept-Language 协商语言,并把手动切换的选择记住一年。英文站保持在根路径、中文站在 /zh 下,每种语言的每个页面仍只有一个规范 URL。


2026 年 6 月

Playground 体验升级与图像生成

Playground 完成了一轮完整的体验升级:流式输出渲染更顺滑,Markdown 与代码高亮全面打磨,报错信息附带可操作的下一步,按 Esc 可随时停止生成,模型选择器直接显示每次调用的价格。图像生成现在是 Playground 的一等模式——选择图像模型、输入提示词、可选附带最多 4 张参考图,在对话流里直接生成图片。

4 个新落地页与机器可读 Facts 扩充

新增 4 个中英双语落地页——/smart-routing、/llm-cost-tracking、/helicone-alternative、/use-cases/ai-coding-tools——补全了网关内容矩阵。机器可读的 facts 同步扩充:新增 /facts/routing.md 与 /facts/pricing.md,并为网关与对比页面提供 Markdown 镜像,确保 AI 爬虫读到的内容与渲染页面完全一致。

CC Switch 图形化配置指南

文档新增 CC Switch 指南:一个图形化工具,无需手动编辑配置文件即可为 Claude Code 和 OpenAI Codex 配置 base URL 与 API Key。指南提供中英双语版本。


2026 年 5 月

订阅套餐上线

Pro、Max、Ultra 三档订阅套餐于 5 月 21 日正式上线,面向需要可预期月度定价的团队。钱包按 token 计费保持不变——订阅与钱包并行,而不是取代。完整说明见上线公告


2026 年 4 月

Google 与 GitHub 第三方登录

现在你可以使用 Google 或 GitHub 账号登录 Router One。这是邮箱登录之外的补充选项,对于已经在用这些身份服务的开发者来说,上手会更快。OAuth 与邮箱登录会进入同一个 Router One 账号和 Dashboard;当前公开产品不提供组织/RBAC 管理层。

Google Search Console 集成

我们把 Google Search Console 的站点验证与 sitemap 管理整合进了平台,作为提升 Router One 文档与对外页面可发现性的一部分工作。对于在我们平台上构建产品的用户来说,这也意味着任何通过 Router One 提供的文档或落地页都能用上更完善的 SEO 工具链。

Dashboard 性能优化

主控台首屏加载提速 40%,得益于服务端渲染优化和图表组件的懒加载。用量曲线和成本明细现在是渐进式渲染——关键数字会立刻出现,不必等到整页 hydrate 完成。


2026 年 3 月

模型市场与价格明细

全新的模型市场清晰展示了 Router One 上的每一个 LLM,包含按输入/输出 token 实时定价、能力标签和上下文窗口大小。可以在控制台里直接横向对比,做路由决策时不再需要查文档。

上线当时,市场覆盖 OpenAI、Anthropic、Google、Mistral、DeepSeek、Meta 的模型。目录会持续更新——当前可调用的模型以模型页为准。

中英双语全面支持

Router One 的 Dashboard 与文档现已完整支持中英文。语言会根据浏览器自动切换,也可以在账号设置里手动指定。所有 UI 文案、错误信息、帮助内容和 API 文档都做了完整翻译——不是机翻,而是由母语者审校以保证准确性和可读性。

实时用量 Dashboard

用量 Dashboard 现在完全实时刷新,无需手动点击。可以实时观察 token 消耗、费用累积和请求量,包含:

  • 按模型拆分——清楚看到每个模型花了多少钱
  • 按 Key 拆分——为每个项目、工具或团队分配独立 Key,并追踪各自用量
  • 按请求 Trace——查看模型、token、成本、延迟、状态和 Key 元数据
  • 时间序列图——按小时、天、周看趋势
  • 异常指示——当用量偏离历史水位时自动标红

落地页改版

对外站点完成了完整改版,文案更清晰、加载更快,更准确地解释了 Router One 的价值定位:面向国内开发者的 LLM API 流量提供智能路由、自动 fallback、每请求级可观测。


2026 年 2 月

Provider 选路与健康信号

核心路由引擎正式上线。请求声明模型后,网关会选择可用 provider 线路;服务端自适应策略可以在候选排序时使用近期 EWMA 延迟、公示成本和可靠性信号。

公开 Dashboard 不提供项目级或 API Key 级路由权重。候选策略由网关配置,每请求 Trace 记录最终模型与 provider。

自动 Fallback

当某个上游出现可重试的供给、限流、服务或超时错误时,Router One 可以尝试其他可用候选。健康状态与短期 cooldown 会降低异常线路优先级,并在恢复后重新纳入。

Fallback 实际耗时包含失败尝试和下一 provider 响应,因此没有统一的毫秒保证。Dashboard 记录最终线路与请求指标,运维侧可用 request ID 关联失败尝试。

微信支付与支付宝接入

已变更(2026-07-25):目前不支持微信支付,人民币充值改走托管收银台里的支付宝,银行卡同一个收银台。

当时国内用户除了国际信用卡,也可以用微信支付和支付宝给账户充值,实时到账、余额秒级更新。这解决了主要在中国运营的团队最大的接入摩擦之一。

预算与 QPS 限额

每把 API Key 都可以独立设置 maxSpend 消费上限、rateLimit 和 tokenLimitTpm。为不同应用、项目或工具创建独立 Key 即可隔离风险;maxSpend 用尽后,即使账号钱包仍有余额,这把 Key 的请求也会停止。


2026 年 1 月

平台正式上线

Router One 正式发布。首发版本包含整个平台的基础设施:

统一 LLM API 入口。 单一 OpenAI 兼容端点(https://api.router.one/v1),接受 Chat Completions 请求并路由到对应模型。首发支持 GPT、Claude、Gemini、Mistral、DeepSeek 模型系列(目录此后已更新,当前以模型页为准),请求和响应 schema 统一。

Claude Code 与 Codex 支持。 Router One 可以作为 Anthropic Claude Code CLI 和 OpenAI Codex CLI 的 base URL 直接替换。配好 base URL 和 Router One 的 API Key,所有请求都会经过平台,享受完整追踪和预算管控。

API Key 隔离。 一个账号可以创建多把 API Key,为不同应用、项目、工具或环境分配独立 Key。每把 Key 有自己的消费与限流控制;组织角色和 RBAC 不属于本次公开能力。

可观测性基础。 每一次请求都会记录计费与路由元数据:使用的模型、输入/输出 token、费用、延迟、状态和 API Key。这些数据驱动用量 Dashboard 与每请求 Trace,同时不保留 prompt 或 completion 正文。

预付费余额体系。 充值后按调用消耗,钱包余额随用量下降,需要时可以继续充值;按 Key 的 maxSpend 可以限制单个工作负载。


接下来要做什么

我们不会预告尚未发布的功能——路线图条目会在正式上线后同步到本页。此前列在这里的订阅套餐已于 2026 年 5 月 21 日上线,详见上方「2026 年 5 月」条目。

新版本发布后会同步更新到本页。

相关权威页面

这篇文章归入「LLM API 网关与路由」主题,以下页面作为商业页、配置文档、证据页和信任事实源。

商业主页面Router One API 网关承接统一模型调用、路由、fallback、预算和观测的产品首页。API 文档Router One API 文档OpenAI 兼容端点、CLI 配置和模型调用示例。证据页智能路由方法论路由信号、最终模型与 provider,以及客户侧 trace 的字段边界。对比页OpenRouter 替代方案专业对比全球模型目录与中国友好路由、支付能力的差异。信任页可引用事实表面向搜索爬虫、AI 答案引擎和客户的稳定事实源。数据留存数据留存政策prompt/completion 留存边界和请求元数据政策。网关页面统一 LLM API 网关一个 OpenAI 兼容端点接入整个模型目录,含路由、fallback 与预算控制。路由页面智能模型路由候选排序如何使用延迟、公示成本与可靠性信号。故障转移页面LLM 供应商故障转移什么样的请求才符合在另一条健康供应商路由上重试的条件。可观测页面逐请求 Trace 日志每个请求的最终模型与供应商、Token、延迟、状态与报错。兼容性页面OpenAI 兼容端点沿用 OpenAI SDK,只改 base URL 即可触达各个模型系列。成本追踪页面LLM 成本追踪按 Key、按模型、按请求的花费归因,配合硬性消费上限。转售方页面在 Router One 上搭你自己的 API 服务带消费上限的客户 Key、按 Key 的用量归因,以及明确的「不提供」清单。客户端接入SDK 与客户端配置指南把任意编程 agent、SDK、聊天客户端或 LLM 应用平台指向同一个端点,每个都有专属指南。模型对比模型价格与上下文两两对比每百万 token 单价、上下文窗口与能力,渲染自实时模型目录。

相关阅读