一个 LLM API 网关,调用所有模型
LLM API 网关是你把每一次模型调用都路由经过的统一入口,不必再把每个模型逐个接进应用。Router One 是一个 OpenAI 兼容的网关,用一个 base URL、一把 Key 即可调用 40+ 个模型——GPT、Claude、Gemini、DeepSeek、Mistral、Llama。直接调模型是个黑盒;经过网关,你得到一本账(每次调用花了多少)、一条轨迹(哪个模型、哪条路由处理的)和一套管控(按 Key 的预算与限流)。全球与中国大陆均可直连。
网关能做什么
一个 OpenAI 兼容端点
把现有的 OpenAI SDK 指向 https://api.router.one/v1,即可通过同一套 Chat Completions 接口调用 40+ 个模型——GPT、Claude、Gemini、DeepSeek、Mistral、Llama。无需逐模型换 SDK,无需重写代码。
智能路由
生产流量默认使用 model_name 策略,指定模型不会被替换。发送 model="auto" 时,由服务端候选集合和全局重试预算完成选择;可选自适应信号包括延迟、成本与可靠性,并使用按时间衰减的 EWMA 评分。
自动故障转移
指定模型的请求遇到可重试上游错误时,网关可能尝试下一个能提供同一模型的健康供应商,不会悄悄换成另一个模型。
每请求级 Trace
每次请求都在实时面板中留下最终模型与供应商、Token 数、成本、延迟和状态。内部失败尝试不会逐次展示。
带预算与限流的多 Key
一个账号可创建多把 API Key,每把都有独立的消费上限(maxSpend)、限流(rateLimit)和每分钟 Token 上限(tokenLimitTpm)。为每个应用或环境分配独立作用域的 Key。
预付费按量钱包
充值预付费钱包,按量 token 账单行使用公示模型费率,结账可见的汇率/通道费用单独展示。支持银行卡、微信支付、支付宝、Stripe,以及 USDT/USDC 充值。用多少扣多少。
Claude Code 与 Codex 原生支持
Claude Code 对接 Anthropic 兼容端点 https://api.router.one;OpenAI Codex CLI 使用 OpenAI 兼容 base URL。两者均改一个环境变量即可接入。
全球 + 中国直连
同一个网关既可从全球网络访问,也可从中国大陆直连,一次集成即可同时服务两侧团队,无需另做配置。
账本、轨迹与管控
网关位于你的应用和模型之间,因此能做三件直接调用做不到的事。账本记录每次请求按公示费率的花费,从预付费钱包中扣减。轨迹记录每次请求由哪个模型、哪个供应商、哪条路由处理,并附带 Token 与延迟。管控层在请求到达供应商之前就执行按 Key 的预算与限流,让失控循环或泄露的 Key 无法掏空钱包。
改一个 base URL 即可接入
Router One 使用 OpenAI Chat Completions API 规范,绝大多数集成只需改 base URL 和 Key 即可迁移。设置好两个环境变量,现有代码照常运行。
# 把每一次模型调用都路由经过网关 export OPENAI_BASE_URL=https://api.router.one/v1 export OPENAI_API_KEY=sk-your-router-one-key
常见问题
什么是 LLM API 网关?
LLM API 网关是你把每一次模型调用都路由经过的统一端点,无需逐个接入各家供应商。它在一处提供调用 40+ 个模型的统一接口,加上路由、故障转移、成本与延迟 Trace,以及按 Key 的预算管控——为你的模型用量提供一本账、一条轨迹和一套管控。
Router One 是 OpenAI 兼容的吗?
是的。Router One 在 https://api.router.one/v1 实现了 OpenAI Chat Completions API,所有支持 OpenAI 的库和工具改个 base URL 就能用。Claude Code 使用 Anthropic 兼容端点 https://api.router.one。
可以调用哪些模型?
覆盖主流模型族的 40+ 个模型——GPT、Claude、Gemini、DeepSeek、Mistral、Llama,都通过同一个统一端点调用。完整目录和每个模型的费率见 /models 页。
路由如何决定用哪个模型?
生产环境默认使用 model_name 策略,按你指定的模型路由。发送 model="auto" 时,由服务端候选集合在全局重试预算内选择;可选自适应信号包括延迟、成本与可靠性,并使用按时间衰减的 EWMA 评分。Dashboard 展示最终模型与供应商。
供应商故障了怎么办?
指定模型的请求遇到可重试上游错误时,可能改由下一个能提供同一模型的健康供应商重试。Dashboard 展示最终供应商和请求指标,不展示每次内部失败尝试。
计费如何运作?
你充值预付费钱包,按量 token 账单行使用公示模型费率,结账可见的汇率/通道费用单独展示。支持银行卡、微信支付、支付宝、Stripe 以及 USDT/USDC 充值。每把 API Key 可设独立的消费上限和限流,用量始终在预算之内。
相关页面
让每一次模型调用都经过同一个网关。
立即接入