跳到主要内容
Router One

一个 LLM API 网关,调用所有模型

LLM API 网关是你把每一次模型调用都路由经过的统一入口,不必再把每个模型逐个接进应用。Router One 是一个 OpenAI 兼容的网关,用一个 base URL、一把 Key 即可调用 30+ 个模型——GPT、Claude、Gemini、Grok。直接调模型是个黑盒;经过网关,你得到一本账(每次调用花了多少)、一条轨迹(哪个模型、哪条路由处理的)和一套管控(按 Key 的预算与限流)。全球与中国大陆均可直连。

网关能做什么

一个 OpenAI 兼容端点

把现有的 OpenAI SDK 指向 https://api.router.one/v1,即可通过同一套 Chat Completions 接口调用 30+ 个模型——GPT、Claude、Gemini、Grok。无需逐模型换 SDK,无需重写代码。

智能路由

生产流量默认使用 model_name 策略,指定模型不会被替换。发送 model="auto" 时,由服务端候选集合和全局重试预算完成选择;可选自适应信号包括延迟、成本与可靠性,并使用按时间衰减的 EWMA 评分。

自动故障转移

指定模型的请求遇到可重试上游错误时,网关可能尝试下一个能提供同一模型的健康供应商,不会悄悄换成另一个模型。

逐请求 Trace

每次请求都在实时面板中留下最终模型与供应商、Token 数、成本、延迟和状态。内部失败尝试不会逐次展示。

带预算与限流的多 Key

一个账号可创建多把 API Key,每把都有独立的消费上限(maxSpend)、限流(rateLimit)和每分钟 Token 上限(tokenLimitTpm)。为每个应用或环境分配独立作用域的 Key。

预付费按量钱包

充值预付费钱包,按量调用按各模型公示单价逐笔计费,汇率与支付通道费在结账页单独列出。支付宝或银行卡在同一个托管收银台完成充值,也支持 6 条链上的 USDT/USDC。用多少扣多少。

Claude Code 与 Codex 原生支持

Claude Code 对接 Anthropic 兼容端点 https://api.router.one;OpenAI Codex CLI 使用 OpenAI 兼容 base URL。Claude Code 改一个环境变量即可;Codex CLI 在 ~/.codex/config.toml 里加一段三行的 provider 配置(base_url、wire_api = "responses"、env_key),再导出对应的 Key。

全球 + 中国直连

同一个网关既可从全球网络访问,也可从中国大陆直连,一次集成即可同时服务两侧团队,无需另做配置。

账本、轨迹与管控

网关位于你的应用和模型之间,因此能做三件直接调用做不到的事。账本记录每次请求按公示费率的花费,从预付费钱包中扣减。轨迹记录每次请求由哪个模型、哪个供应商、哪条路由处理,并附带 Token 与延迟。管控层在请求到达供应商之前就执行按 Key 的预算与限流,让失控循环或泄露的 Key 无法掏空钱包。

改一个 base URL 即可接入

Router One 使用 OpenAI Chat Completions API 规范,绝大多数集成只需改 base URL 和 Key 即可迁移。设置好两个环境变量,现有代码照常运行。

terminal
# 把每一次模型调用都路由经过网关
export OPENAI_BASE_URL=https://api.router.one/v1
export OPENAI_API_KEY=sk-your-router-one-key

常见问题

什么是 LLM API 网关?

LLM API 网关是你把每一次模型调用都路由经过的统一端点,无需逐个接入各家供应商。它在一处提供调用 30+ 个模型的统一接口,加上路由、故障转移、成本与延迟 Trace,以及按 Key 的预算管控——为你的模型用量提供一本账、一条轨迹和一套管控。

Router One 是 OpenAI 兼容的吗?

Router One 是 OpenAI 兼容的:它在 https://api.router.one/v1 实现了 OpenAI Chat Completions API,所有支持 OpenAI 的库和工具改个 base URL 就能用。Claude Code 使用 Anthropic 兼容端点 https://api.router.one。

可以调用哪些模型?

覆盖主流模型族的 30+ 个模型——GPT、Claude、Gemini、Grok,都通过同一个统一端点调用。完整目录和每个模型的费率见 /models 页。

路由如何决定用哪个模型?

生产环境默认使用 model_name 策略,按你指定的模型路由。发送 model="auto" 时,由服务端候选集合在全局重试预算内选择;可选自适应信号包括延迟、成本与可靠性,并使用按时间衰减的 EWMA 评分。Dashboard 展示最终模型与供应商。

供应商故障了怎么办?

指定模型的请求遇到可重试上游错误时,可能改由下一个能提供同一模型的健康供应商重试。Dashboard 展示最终供应商和请求指标,不展示每次内部失败尝试。

计费如何运作?

你充值预付费钱包,按量调用按各模型公示单价逐笔计费,汇率与支付通道费在结账页单独列出。支付宝或银行卡在同一个托管收银台完成充值,也支持 6 条链上的 USDT/USDC。每把 API Key 可设独立的消费上限和限流,用量始终在预算之内。

按网关评估任务选择下一步

本页负责解释网关层;现有客户端迁移、路由决策、请求成本、最终路由核对、网关选型对比与客户端接入分别由下方唯一入口承接。

迁移迁移现有 OpenAI 客户端在切换生产流量前,先按准确的 base URL 与 Key 配置完成替换,并确认 SDK 兼容请求约定。请求约定核对经网关的结构化输出网关在调用模型前校验 response_format 的哪些部分、原样转发什么,以及为什么强制执行仍由模型负责。路由理解模型与供应商选择了解指定模型请求、auto 选择、候选集合、重试预算与自适应信号如何协同。成本管控追踪请求与 API Key 花费从单次请求的 Token 与计费成本继续查看 API Key 和账号级用量。验证核对最终路由、延迟与成本通过请求 Trace 核对最终模型与供应商、Token 数、延迟、状态和计费成本。选型对比生产级网关与中转 API 平台从稳定性、可追溯与计费口径五个维度,对比托管网关与拼接式中转平台的实际差异。可靠性看请求失败后会发生什么可重试的上游错误(5xx、超时)在存在可用健康线路时按同一个精确请求模型重试——有条件生效,不是零停机保证。客户端接入把你的客户端或 SDK 接进来按客户端进入各自的接入指南,把编辑器、CLI 或 SDK 指向网关端点。框架配置 LlamaIndex把 LlamaIndex 的 OpenAI 兼容 LLM 类指向网关 base URL,改字符串切换模型。模型目录复制当前的模型 ID 与单价实时目录列出网关服务的每个模型 ID、每 1M token 单价、上下文窗口、能力标签,以及它响应的端点。

让每一次模型调用都经过同一个网关。

立即接入