本页记录 Router One 平台上线以来的主要功能、改进与里程碑。我们会在每次新版本发布后同步更新这里。
2026 年 8 月
Grok 4.20 下架,对应对比页退役(8 月 26 日)
Grok 4.20 非推理档已不在目录,Grok API 页的阵容改为 grok-4.6 与 grok-4.5,Grok 4.20 vs DeepSeek V4 Flash 对比页按 Kimi 的先例退役。模型对比每页标题下新增结论段、规格表旁新增「价格读取日期」、相关对比按实时目录过滤,并补上系列落地页、成本计算器与定价方法的链接。
Nano Banana 2 API 指南与 API 参考文档刷新(8 月 25 日)
新增 Nano Banana 2 API 指南,把 gemini-3.1-flash-image-preview 讲完整:POST /v1/images/generations 文生图、POST /v1/images/edits 带参考图改图、按张固定单价,以及和 Nano Banana Pro(gemini-3-pro-image-preview)怎么选;生图 API 页的两张 Gemini 模型卡也标上了这两个名字。API 参考文档按网关实际行为对齐:补上 GET /v1/models,错误体展示网关真实返回的大写下划线 code 与 request_id,429 行改为读 Retry-After 并点名三种配额 code,新增响应头里的限流字段一节,/v1/messages 写明对 Claude 与 DeepSeek V4 之外模型返回的 Anthropic 信封格式 400,生图与视频示例改用目录里的模型 ID 和固定成片规格。Codex / Responses API 页新增说明 Codex 跑 /review 时发送的 codex-auto-review 模型 ID。
视频页重写、对比页新增四对、生图阵容补上 Gemini 3.1 Flash Image(8 月 24 日)
视频生成页改为以目录里真实在售的视频模型开篇,逐个写明固定成片规格,并直接说明 Veo 与 Grok Video 当前不在目录。生图 API 页在 gpt-image-2、Gemini 3 Pro Image、豆包 Seedream 与两个 Grok Imagine 条目之外补上 Gemini 3.1 Flash Image,并写清参考图编辑走 POST /v1/images/edits。错误码页新增开头的 400 行,覆盖「模型用错端点」这一类。模型对比新增四对:DeepSeek V4 Pro vs DeepSeek V4 Flash、Gemini 3.1 Pro vs GPT-5.6 Sol、Grok 4.20 vs DeepSeek V4 Flash(此后已退役——Grok 4.20 于 2026-08-26 下架,该对比页随之撤下)、MiniMax M2.7 vs GLM-5.2;同时下线三对 Kimi 对比——Kimi 已不在目录。
六个视频模型上线,时长与分辨率按模型锁死(8 月 23 日)
viduq3-turbo(5 秒 720p)、viduq3-turbo-540p(4 秒 540p)、pixverse-video(5 秒 540p)、MiniMax-Hailuo-2.3 与 MiniMax-Hailuo-02(6 秒 768P)、wan2.6-i2v(5 秒 720P,图生视频,必须且只能传一张 image_url)都在 POST /v1/videos/generations 上服务:提交任务、按 ID 轮询、下载成片。每个模型只出一种固定的时长×分辨率组合,请求体里写 duration 或 size 也不会改变成片;每条按一个固定单价计费,并记录在该请求的成本 trace 里。实时单价见模型页 video 类别,阵容与调用方式见视频生成页。
Gemini 生图模型:文生图与参考图编辑(8 月 23 日)
目录里的两个 Gemini 生图条目——gemini-3-pro-image-preview 与 gemini-3.1-flash-image-preview——在网关生图链路修复后可在 POST /v1/images/generations 正常出图;两者都支持图片输入,因此也可以走 POST /v1/images/edits 传参考图(multipart/form-data,文件放在 image 字段)。两者与生图阵容其余模型一样按张计一个固定单价。详见生图 API 页。
Claude 模型 ID 发到 /v1/responses 返回 400(8 月 23 日)
把 Claude 家族的模型 ID 发到 /v1/responses,现在会在调用任何模型之前被拒绝,返回 400 invalid_request_error——model '<id>' must be called via /v1/messages or /v1/chat/completions——不消耗 token,报错消息直接给出改法。/v1/responses 原生服务 GPT 与 DeepSeek V4 模型;Claude 系列走 /v1/messages 与 /v1/chat/completions。每个模型详情页列出它支持的端点,完整的端点×系列对照见 API 兼容性事实页。
报告了 usage 的空回复按 200 返回(8 月 23 日)
一次没有正文、没有工具调用、也没有拒答,但报告了 token usage 的回复,是一次已完成的响应而不是故障:网关原样按 HTTP 200 返回,不重试也不切换候选,结算依据是该响应报告的 usage。不要自动重试——先读回复里的 finish_reason、refusal 和 usage,循环重试只是为同一份沉默再付一次钱。完全没有 usage 的空响应仍按上游故障处理:网关换下一个候选,都不成功时返回 502。排查说明见错误码页。
结构化输出指南、Responses 端点矩阵、Gemini 3.7 Flash 对比页、API 兼容性事实页,再加五页 Markdown 镜像(8 月 22 日)
新增 LLM 结构化输出指南,讲清 OpenAI 兼容端点上的 response_format:网关在调用上游之前校验什么、为什么 schema 的执行在模型侧。Codex / Responses API 页 新增端点矩阵,列出 Responses 请求里哪些特性接受、哪些拒绝。模型对比新增两对 Gemini 3.7 Flash:Gemini 3.7 Flash vs GPT-5.4 mini、Gemini 3.7 Flash vs Gemini 3.6 Flash。机器可读的 API 兼容性事实页 写明每个端点家族服务哪些模型系列。另外五个信任类页面——安全、数据留存、路由方法论、定价方法论、国内延迟基准——也有了 .md 镜像,AI 爬虫读到的内容与渲染页面完全一致。
Chat Completions 支持 json_schema 结构化输出透传(8 月 20 日)
response_format 为 type: "json_schema" 的请求现在由网关校验后原样转发给模型。json_schema 块缺 name 或 schema 时,会在调用任何上游之前返回 400 invalid_request_error——response_format.json_schema.name is required / response_format.json_schema.schema is required——格式错误的请求不消耗 token。json_object 模式此前已经透传。schema 的执行在模型侧:模型支持时输出才受约束,所以客户端仍要解析并校验。当某条模型线路拒绝含 $defs 或 $ref 的 schema 时,网关把这次拒绝当作该候选线路自身的 400,转到同一模型的下一个候选。请求形态和细节见结构化输出指南。
Responses API 开放托管工具、文件输入、服务等级与服务端上下文(8 月 19 日)
在 /v1/responses 上,使用 custom tools、previous_response_id、conversation、prompt、托管工具(file_search、code_interpreter、computer_use、mcp、web_search)、file_id / file_url 输入分片以及任意 service_tier 取值的请求,现在在模型详情页列有 POST /v1/responses 的模型上均被接受,按该模型的标准费率计费。function tools 此前已支持。仍会返回 400 invalid_request_error 的:image_generation 工具与 image_generation_call 条目(请改用 /v1/images/generations),以及 background: true。完整矩阵见 Codex / Responses API 页。
模型目录新增 Gemini 3.7 Flash(8 月 17 日)
google/gemini-3.7-flash 上架,支持对话、流式、工具调用与视觉,上下文窗口 1M token。实时单价见其模型页。
新模型潮承接:对比页新增五对、八月新模型指南、n8n 与沉浸式翻译接入指南、SLA 页 Markdown 镜像(8 月 16 日)
2026 年 8 月新模型指南是目录当前一代的叙事伴读——Claude Opus 5、GPT-5.6 家族、Grok 4.6、Kimi K3(其后已不在目录)与 DeepSeek V4 Flash——附一把 Key 改 route key 直接 A/B 的做法。两篇客户端指南上线:n8n,工作流自动化平台——把它 OpenAI 凭证的 Base URL 指向网关,每一步的模型调用都落进同一本账,受按 Key 的 maxSpend 上限约束;沉浸式翻译,双语对照翻译浏览器扩展,它的自定义 OpenAI 兼容接口要填含 /chat/completions 的完整路径。Grok API 国内接入页的模型列表更新到 Grok 4.6,SLA 页新增面向 AI 爬虫的 Markdown 镜像。模型对比新增五对:Grok 4.6 vs GPT-5.6 Sol、Grok 4.6 vs GPT-5.6 Terra、Grok 4.6 vs Grok 4.5、GPT-5.6 Sol vs GPT-5.6 Terra、豆包 Seed 2.0 Lite vs DeepSeek V4 Flash——全部从实时目录渲染。
DeepSeek V4 接入 Anthropic 兼容的 /v1/messages 端点(8 月 15 日)
deepseek-v4-pro 与 deepseek-v4-flash 现在可以通过 /v1/messages——Claude Code 使用的 Anthropic 线格式端点——直接调用,Claude Code 用原来调 Claude 系列的同一个 base URL 和 Key 就能指向这两个模型。/v1/chat/completions 仍然服务全部对话模型;每个模型详情页列出它支持的端点。
Zed、Continue、Open WebUI 接入指南与 Grok API 页面,对比页新增三对(8 月 12 日)
客户端接入目录新增三家:Zed、Continue、Open WebUI 各自上线配置指南,配置项按当前客户端版本在线核实,而不是照抄旧文档。新增 Grok API 国内接入页,讲清如何经网关调用 Grok 系列模型、国内直连可达。模型对比新增三对:Claude Fable 5 vs Claude Opus 5、Claude Fable 5 vs GPT-5.6 Sol、Grok 4.5 vs GPT-5.5——全部从实时目录渲染,规格和单价不会过期。
Cursor 与 OpenClaw 接入指南(8 月 7 日)
两篇新的配置指南上线:Cursor 讲自定义 base URL 与 Key 的填法,与 CLI 工具共用同一个钱包和请求 trace;OpenClaw 讲如何把 agent 指向 OpenAI 兼容端点。两页均为中英双语。
托管收银台充值可开发票(8 月 4 日)
发票政策统一:任何通过托管收银台(支付宝或银行卡)完成的充值都可以开票——普通按量钱包充值同样可以,不限于企业或订阅账户。稳定币充值属于另一条通道,不在开票范围内。开票请发邮件到 support@router.one 并附上账户 ID。
2026 年 7 月
Claude Code 与 Codex 一键接入,新增快速开始与 FAQ 文档(7 月 24 日)
接入 CLI 不再需要手动改配置文件。一条安装命令即可完成配置:Claude Code 会把网关 base URL 与鉴权 token 写进 ~/.claude/settings.json 的 env 块;Codex CLI 会生成带 env_key 的 ~/.codex/config.toml,并把 Key 的 export 追加到 shell 配置文件。脚本覆盖 macOS、Linux 与 Windows PowerShell。文档同步新增两页:快速开始带你在五分钟内跑通两套协议下的第一个请求,常见问题与排障讲清 Base URL 选择与 401/402/429 的排查路径。
支付宝并入托管收银台,充值金额可自由填写(7 月 24 日)
钱包充值统一走同一个托管收银台,可选支付宝或银行卡;金额输入框也从固定档位改为可自由填写。支付宝或银行卡在同一个托管收银台完成充值,也支持 6 条链上的 USDT/USDC(Tron、BSC、以太坊、Polygon、Base、Arbitrum),无需美国信用卡。
生图与视频场景页上线(7 月 18 日)
新增三个承接生成类负载的页面:文生图 API 页 讲 OpenAI 兼容端点背后的文生图模型,Veo 视频 API 页 讲异步视频生成,另有一篇中英双语博客指南讲国内如何调用这两类接口。媒体模型按生成的张/条计价,而不是按 token,每个模型的单价见模型目录。
站点语言自动识别(7 月 10 日)
对外站点现在会在首次访问时根据浏览器的 Accept-Language 协商语言,并把手动切换的选择记住一年。英文站保持在根路径、中文站在 /zh 下,每种语言的每个页面仍只有一个规范 URL。
2026 年 6 月
Playground 体验升级与图像生成
Playground 完成了一轮完整的体验升级:流式输出渲染更顺滑,Markdown 与代码高亮全面打磨,报错信息附带可操作的下一步,按 Esc 可随时停止生成,模型选择器直接显示每次调用的价格。图像生成现在是 Playground 的一等模式——选择图像模型、输入提示词、可选附带最多 4 张参考图,在对话流里直接生成图片。
4 个新落地页与机器可读 Facts 扩充
新增 4 个中英双语落地页——/smart-routing、/llm-cost-tracking、/helicone-alternative、/use-cases/ai-coding-tools——补全了网关内容矩阵。机器可读的 facts 同步扩充:新增 /facts/routing.md 与 /facts/pricing.md,并为网关与对比页面提供 Markdown 镜像,确保 AI 爬虫读到的内容与渲染页面完全一致。
CC Switch 图形化配置指南
文档新增 CC Switch 指南:一个图形化工具,无需手动编辑配置文件即可为 Claude Code 和 OpenAI Codex 配置 base URL 与 API Key。指南提供中英双语版本。
2026 年 5 月
订阅套餐上线
Pro、Max、Ultra 三档订阅套餐于 5 月 21 日正式上线,面向需要可预期月度定价的团队。钱包按 token 计费保持不变——订阅与钱包并行,而不是取代。完整说明见上线公告。
2026 年 4 月
Google 与 GitHub 第三方登录
现在你可以使用 Google 或 GitHub 账号登录 Router One。这是邮箱登录之外的补充选项,对于已经在用这些身份服务的开发者来说,上手会更快。OAuth 与邮箱登录会进入同一个 Router One 账号和 Dashboard;当前公开产品不提供组织/RBAC 管理层。
Google Search Console 集成
我们把 Google Search Console 的站点验证与 sitemap 管理整合进了平台,作为提升 Router One 文档与对外页面可发现性的一部分工作。对于在我们平台上构建产品的用户来说,这也意味着任何通过 Router One 提供的文档或落地页都能用上更完善的 SEO 工具链。
Dashboard 性能优化
主控台首屏加载提速 40%,得益于服务端渲染优化和图表组件的懒加载。用量曲线和成本明细现在是渐进式渲染——关键数字会立刻出现,不必等到整页 hydrate 完成。
2026 年 3 月
模型市场与价格明细
全新的模型市场清晰展示了 Router One 上的每一个 LLM,包含按输入/输出 token 实时定价、能力标签和上下文窗口大小。可以在控制台里直接横向对比,做路由决策时不再需要查文档。
上线当时,市场覆盖 OpenAI、Anthropic、Google、Mistral、DeepSeek、Meta 的模型。目录会持续更新——当前可调用的模型以模型页为准。
中英双语全面支持
Router One 的 Dashboard 与文档现已完整支持中英文。语言会根据浏览器自动切换,也可以在账号设置里手动指定。所有 UI 文案、错误信息、帮助内容和 API 文档都做了完整翻译——不是机翻,而是由母语者审校以保证准确性和可读性。
实时用量 Dashboard
用量 Dashboard 现在完全实时刷新,无需手动点击。可以实时观察 token 消耗、费用累积和请求量,包含:
- 按模型拆分——清楚看到每个模型花了多少钱
- 按 Key 拆分——为每个项目、工具或团队分配独立 Key,并追踪各自用量
- 按请求 Trace——查看模型、token、成本、延迟、状态和 Key 元数据
- 时间序列图——按小时、天、周看趋势
- 异常指示——当用量偏离历史水位时自动标红
落地页改版
对外站点完成了完整改版,文案更清晰、加载更快,更准确地解释了 Router One 的价值定位:面向国内开发者的 LLM API 流量提供智能路由、自动 fallback、每请求级可观测。
2026 年 2 月
Provider 选路与健康信号
核心路由引擎正式上线。请求声明模型后,网关会选择可用 provider 线路;服务端自适应策略可以在候选排序时使用近期 EWMA 延迟、公示成本和可靠性信号。
公开 Dashboard 不提供项目级或 API Key 级路由权重。候选策略由网关配置,每请求 Trace 记录最终模型与 provider。
自动 Fallback
当某个上游出现可重试的供给、限流、服务或超时错误时,Router One 可以尝试其他可用候选。健康状态与短期 cooldown 会降低异常线路优先级,并在恢复后重新纳入。
Fallback 实际耗时包含失败尝试和下一 provider 响应,因此没有统一的毫秒保证。Dashboard 记录最终线路与请求指标,运维侧可用 request ID 关联失败尝试。
微信支付与支付宝接入
已变更(2026-07-25):目前不支持微信支付,人民币充值改走托管收银台里的支付宝,银行卡同一个收银台。
当时国内用户除了国际信用卡,也可以用微信支付和支付宝给账户充值,实时到账、余额秒级更新。这解决了主要在中国运营的团队最大的接入摩擦之一。
预算与 QPS 限额
每把 API Key 都可以独立设置 maxSpend 消费上限、rateLimit 和 tokenLimitTpm。为不同应用、项目或工具创建独立 Key 即可隔离风险;maxSpend 用尽后,即使账号钱包仍有余额,这把 Key 的请求也会停止。
2026 年 1 月
平台正式上线
Router One 正式发布。首发版本包含整个平台的基础设施:
统一 LLM API 入口。 单一 OpenAI 兼容端点(https://api.router.one/v1),接受 Chat Completions 请求并路由到对应模型。首发支持 GPT、Claude、Gemini、Mistral、DeepSeek 模型系列(目录此后已更新,当前以模型页为准),请求和响应 schema 统一。
Claude Code 与 Codex 支持。 Router One 可以作为 Anthropic Claude Code CLI 和 OpenAI Codex CLI 的 base URL 直接替换。配好 base URL 和 Router One 的 API Key,所有请求都会经过平台,享受完整追踪和预算管控。
API Key 隔离。 一个账号可以创建多把 API Key,为不同应用、项目、工具或环境分配独立 Key。每把 Key 有自己的消费与限流控制;组织角色和 RBAC 不属于本次公开能力。
可观测性基础。 每一次请求都会记录计费与路由元数据:使用的模型、输入/输出 token、费用、延迟、状态和 API Key。这些数据驱动用量 Dashboard 与每请求 Trace,同时不保留 prompt 或 completion 正文。
预付费余额体系。 充值后按调用消耗,钱包余额随用量下降,需要时可以继续充值;按 Key 的 maxSpend 可以限制单个工作负载。
接下来要做什么
我们不会预告尚未发布的功能——路线图条目会在正式上线后同步到本页。此前列在这里的订阅套餐已于 2026 年 5 月 21 日上线,详见上方「2026 年 5 月」条目。
新版本发布后会同步更新到本页。