# 一个 LLM API 网关，调用所有模型

> https://router.one/zh/llm-api-gateway 的 Markdown 镜像，供 AI 助手与爬虫使用。Router One 是 OpenAI 兼容的统一 LLM API 网关。
> 最后更新：2026-09-05

LLM API 网关是你把每一次模型调用都路由经过的统一入口，不必再把每个模型逐个接进应用。Router One 是一个 OpenAI 兼容的网关，用一个 base URL、一把 Key 即可调用 30+ 个模型——GPT、Claude、Gemini、Grok。直接调模型是个黑盒；经过网关，你得到一本账（每次调用花了多少）、一条轨迹（哪个模型、哪条路由处理的）和一套管控（按 Key 的预算与限流）。全球与中国大陆均可直连。

## 网关能做什么

### 一个 OpenAI 兼容端点

把现有的 OpenAI SDK 指向 https://api.router.one/v1，即可通过同一套 Chat Completions 接口调用 30+ 个模型——GPT、Claude、Gemini、Grok。无需逐模型换 SDK，无需重写代码。

### 智能路由

生产流量默认使用 model_name 策略，指定模型不会被替换。发送 model="auto" 时，由服务端候选集合和全局重试预算完成选择；可选自适应信号包括延迟、成本与可靠性，并使用按时间衰减的 EWMA 评分。

### 自动故障转移

指定模型的请求遇到可重试上游错误时，网关可能尝试下一个能提供同一模型的健康供应商，不会悄悄换成另一个模型。

### 逐请求 Trace

每次请求都在实时面板中留下最终模型与供应商、Token 数、成本、延迟和状态。内部失败尝试不会逐次展示。

### 带预算与限流的多 Key

一个账号可创建多把 API Key，每把都有独立的消费上限（maxSpend）、限流（rateLimit）和每分钟 Token 上限（tokenLimitTpm）。为每个应用或环境分配独立作用域的 Key。

### 预付费按量钱包

充值预付费钱包，按量调用按各模型公示单价逐笔计费，汇率与支付通道费在结账页单独列出。支付宝或银行卡在同一个托管收银台完成充值，也支持 6 条链上的 USDT/USDC。用多少扣多少。

### Claude Code 与 Codex 原生支持

Claude Code 对接 Anthropic 兼容端点 https://api.router.one；OpenAI Codex CLI 使用 OpenAI 兼容 base URL。Claude Code 改一个环境变量即可；Codex CLI 在 ~/.codex/config.toml 里加一段三行的 provider 配置（base_url、wire_api = "responses"、env_key），再导出对应的 Key。

### 全球 + 中国直连

同一个网关既可从全球网络访问，也可从中国大陆直连，一次集成即可同时服务两侧团队，无需另做配置。

## 账本、轨迹与管控

网关位于你的应用和模型之间，因此能做三件直接调用做不到的事。账本记录每次请求按公示费率的花费，从预付费钱包中扣减。轨迹记录每次请求由哪个模型、哪个供应商、哪条路由处理，并附带 Token 与延迟。管控层在请求到达供应商之前就执行按 Key 的预算与限流，让失控循环或泄露的 Key 无法掏空钱包。

## 改一个 base URL 即可接入

Router One 使用 OpenAI Chat Completions API 规范，绝大多数集成只需改 base URL 和 Key 即可迁移。设置好两个环境变量，现有代码照常运行。

```bash
# 把每一次模型调用都路由经过网关
export OPENAI_BASE_URL=https://api.router.one/v1
export OPENAI_API_KEY=sk-your-router-one-key
```

## 常见问题

### 什么是 LLM API 网关？

LLM API 网关是你把每一次模型调用都路由经过的统一端点，无需逐个接入各家供应商。它在一处提供调用 30+ 个模型的统一接口，加上路由、故障转移、成本与延迟 Trace，以及按 Key 的预算管控——为你的模型用量提供一本账、一条轨迹和一套管控。

### Router One 是 OpenAI 兼容的吗？

Router One 是 OpenAI 兼容的：它在 https://api.router.one/v1 实现了 OpenAI Chat Completions API，所有支持 OpenAI 的库和工具改个 base URL 就能用。Claude Code 使用 Anthropic 兼容端点 https://api.router.one。

### 可以调用哪些模型？

覆盖主流模型族的 30+ 个模型——GPT、Claude、Gemini、Grok，都通过同一个统一端点调用。完整目录和每个模型的费率见 /models 页。

### 路由如何决定用哪个模型？

生产环境默认使用 model_name 策略，按你指定的模型路由。发送 model="auto" 时，由服务端候选集合在全局重试预算内选择；可选自适应信号包括延迟、成本与可靠性，并使用按时间衰减的 EWMA 评分。Dashboard 展示最终模型与供应商。

### 供应商故障了怎么办？

指定模型的请求遇到可重试上游错误时，可能改由下一个能提供同一模型的健康供应商重试。Dashboard 展示最终供应商和请求指标，不展示每次内部失败尝试。

### 计费如何运作？

你充值预付费钱包，按量调用按各模型公示单价逐笔计费，汇率与支付通道费在结账页单独列出。支付宝或银行卡在同一个托管收银台完成充值，也支持 6 条链上的 USDT/USDC。每把 API Key 可设独立的消费上限和限流，用量始终在预算之内。

## 相关页面

- 迁移现有 OpenAI 客户端：https://router.one/zh/openai-compatible-api
- 核对经网关的结构化输出：https://router.one/zh/llm-structured-outputs
- 理解模型与供应商选择：https://router.one/zh/smart-routing
- 追踪请求与 API Key 花费：https://router.one/zh/llm-cost-tracking
- 核对最终路由、延迟与成本：https://router.one/zh/llm-observability
- 对比生产级网关与中转 API 平台：https://router.one/zh/blog/official-llm-gateway-vs-api-relays
- 看请求失败后会发生什么：https://router.one/zh/llm-fallback
- 把你的客户端或 SDK 接进来：https://router.one/zh/integrations
- 配置 LlamaIndex：https://router.one/zh/integrations/llamaindex
- 本页规范地址：https://router.one/zh/llm-api-gateway
- 模型与每模型 token 价格：https://router.one/zh/models （markdown：https://router.one/zh/models.md ）
- 定价：https://router.one/zh/pricing
- API 文档（markdown）：https://router.one/zh/docs.md
- 公司事实（markdown）：https://router.one/zh/facts/company.md
