一条连接,让 Open WebUI 背靠整个模型目录
Open WebUI 是部署最广的自托管聊天界面,任何 OpenAI 兼容端点都能作为它的后端。把 Router One 添加为连接后,模型目录会经 /models 端点自动发现——GPT、Claude、Gemini、Grok 系列直接出现在实例所有用户的模型选择器里,每次对话在网关侧都有成本 Trace。网关在大陆可直连,实例部署在国内服务器上也无需代理。
把 Open WebUI 配置到 Router One base URL
已在运行的实例里,打开 Admin Panel → Settings → Connections,添加一条 OpenAI API 连接,填入网关地址和 Key,模型会自动发现——想收窄用户可见的列表,用连接里的模型 ID 过滤即可。全新的 Docker 部署也可以用两个环境变量在首次启动时写入同一条连接:
# Open WebUI → Admin Panel → Settings → Connections → OpenAI API URL: https://api.router.one/v1 API Key: sk-your-router-one-key # Or seed the connection at first launch: docker run -d -p 3000:8080 \ -e OPENAI_API_BASE_URL=https://api.router.one/v1 \ -e OPENAI_API_KEY=sk-your-router-one-key \ ghcr.io/open-webui/open-webui:main
Open WebUI 该填哪个模型 ID?
从 /models 页复制精确的模型 ID,保留大小写、连字符和版本后缀,不要用展示名称代替。打开该模型的详情页,核对支持的 API 端点、上下文窗口和工具调用等能力,再与 Open WebUI 当前选择的 provider 和功能对应。模型出现在目录里,不等于当前客户端能调用它的所有功能。建议为每个工具单独建 API Key,并设置 maxSpend 消费上限。
Open WebUI 用的是哪种 API 协议?
OpenAI 兼容描述的是接口格式,不能据此推断 Chat Completions(/v1/chat/completions)、Responses(/v1/responses)和 Anthropic Messages(/v1/messages)可以互换。先核对工具当前版本、provider 配置和实际请求路径,再查模型详情与 API 兼容性事实页。一次普通对话成功,也不能证明服务端工具、历史状态或文件编辑功能都受支持。
在 trace 里验证 Open WebUI 的调用
先在 Open WebUI 发出一次简单文本请求,再到 Dashboard → Logs 按时间、模型和 request_id 核对 trace:tokens、花费、延迟和状态码。成功后再分别验证流式输出、工具调用和多轮历史。失败时保留实际请求路径、完整错误消息及 request_id;没有对应日志时,先查客户端配置和网络,不能仅凭客户端报错认定是网关或上游故障。
常见问题
改了 OPENAI_API_BASE_URL 环境变量,Open WebUI 为什么没反应?
连接设置是持久化配置:Open WebUI 首次启动时就把它写进了数据库,之后再改环境变量会被忽略。请到 Admin Panel → Settings → Connections 里直接改这条连接,或者换一个全新的数据卷重新部署。
Open WebUI 能通过网关用哪些模型?
选用当前目录中同时支持 Open WebUI 所用端点和所需功能的模型。精确 ID、当前单价与能力以 /models 及模型详情为准;不要仅按 GPT、Claude 等系列名判断兼容性。客户端能列出模型,只证明模型发现成功,仍需验证实际调用。
能列出模型,但调用报 400 或 404,怎么办?
先记录实际请求路径和错误消息,再核对精确模型 ID。400 可能是参数、工具类型或模型与端点不匹配;404 可能是请求路径或资源不存在,不能直接判定模型下线。若错误提示 must be called via,按它指明的端点调整客户端 provider,或换用支持当前端点的模型。不要在所有工具里统一增删 /v1 或 /chat/completions。
中国大陆能直连吗?
能。网关在大陆可直连、无需 VPN,配置与全球环境完全一致。
报 401/402/403/429 怎么排查?
先到 Dashboard → Logs 核对请求及错误消息。401 查 Key 是否传入和有效;402 查钱包余额与 maxSpend;403 查 Key 权限和访问限制;429 查请求频率、token 限额及上游限流,按错误来源处理。保留 request_id,再按错误码速查页逐项排查。