跳到主要内容
Router One

Gemini 3.1 Flash Lite vs GPT-5.4 mini

GPT-5.4 mini 在 Router One 上更便宜——按 1M 输入 + 1M 输出的配比约低 79%。Gemini 3.1 Flash Lite 上下文 1.05M,GPT-5.4 mini 为 400K。Gemini 3.1 Flash Lite 可走 /v1/chat/completions;GPT-5.4 mini 可走 /v1/chat/completions、/v1/responses(Codex CLI)。

Gemini 3.1 Flash Lite 与 GPT-5.4 mini 的当前单价、上下文窗口与能力对比——两者都能通过同一个 OpenAI 兼容端点调用,每次请求带成本 trace。

Gemini 3.1 Flash Lite 与 GPT-5.4 mini:单价、上下文窗口与能力对比

规格Gemini 3.1 Flash LiteGPT-5.4 mini
输入 / 1M tokens$0.25$0.075
输出 / 1M tokens$1.50$0.30
缓存输入 / 1M tokens$0.25$0.00375
上下文窗口1.05M400K
详情页Gemini 3.1 Flash LiteGPT-5.4 mini

Gemini 3.1 Flash Lite 与 GPT-5.4 mini 跑 1M tokens 各要多少钱?

按当前单价计算 1M 输入 + 1M 输出 tokens 的负载:Gemini 3.1 Flash Lite 合计 $1.75,GPT-5.4 mini 合计 $0.375——在这个配比下 GPT-5.4 mini 约便宜 79%。真实负载通常严重偏向输入 tokens,请按你自己的输入/输出比例衡量;上表的「缓存输入」一行是该模型的目录公示价。

在 Gemini 3.1 Flash Lite 与 GPT-5.4 mini 之间切换,不改代码

两个模型都在同一个 OpenAI 兼容端点后面,A/B 测试只是改一个 model 字符串——key、base URL、请求结构都不变,每次请求的 tokens、花费、延迟都记录在控制台:

compare.sh
curl https://api.router.one/v1/chat/completions \
  -H "Authorization: Bearer sk-your-router-one-key" \
  -H "Content-Type: application/json" \
  -d '{"model": "google/gemini-3.1-flash-lite", "messages": [{"role": "user", "content": "Hello"}]}'

# Same request, other model — change one string:
#   "model": "openai/gpt-5.4-mini"

常见问题

Gemini 3.1 Flash Lite 比 GPT-5.4 mini 便宜吗?

输入:Gemini 3.1 Flash Lite $0.25 vs GPT-5.4 mini $0.075 / 1M tokens,GPT-5.4 mini 更低。输出:Gemini 3.1 Flash Lite $1.50 vs GPT-5.4 mini $0.30 / 1M tokens,GPT-5.4 mini 更低。实际总成本取决于输入、输出和缓存的用量配比。价格会变化;/models 页面是实时来源。

在 Gemini 3.1 Flash Lite 和 GPT-5.4 mini 之间切换要改代码吗?

不用。两者走同一个 OpenAI 兼容端点,切换就是改请求里的 model 字符串——key、base URL、请求结构完全不变。

这些数字从哪来?

本页的规格和价格直接渲染自 Router One 实时模型目录——与 /models 页同源,并随之刷新。定价方法见 /pricing-methodology。本页价格于 2026-09-07(UTC)读取自实时目录,一小时内自动刷新。

更多对比