跳到主要内容
注册

Gemini 3.5 Flash Lite vs Gemini 3.1 Flash Lite

Gemini 3.1 Flash Lite 在 Router One 上更便宜——按 1M 输入 + 1M 输出的配比约低 37%。两者上下文窗口同为 1.05M。两者都可走 /v1/chat/completions。

Gemini 3.5 Flash Lite 与 Gemini 3.1 Flash Lite 的当前单价、上下文窗口与能力对比——两者都能通过同一个 OpenAI 兼容端点调用,每次请求带成本 trace。

Gemini 3.5 Flash Lite 与 Gemini 3.1 Flash Lite:单价、上下文窗口与能力对比

规格Gemini 3.5 Flash LiteGemini 3.1 Flash Lite
输入 / 1M tokens$0.30$0.25
输出 / 1M tokens$2.50$1.50
缓存输入 / 1M tokens$0.30$0.25
上下文窗口1.05M1.05M
能力对话、流式输出、工具调用、视觉理解对话、流式输出、工具调用、视觉理解
套餐覆盖不在任何套餐 — 钱包计费不在任何套餐 — 钱包计费
详情页Gemini 3.5 Flash LiteGemini 3.1 Flash Lite

Gemini 3.5 Flash Lite 与 Gemini 3.1 Flash Lite 跑 1M tokens 各要多少钱?

按当前单价计算 1M 输入 + 1M 输出 tokens 的负载:Gemini 3.5 Flash Lite 合计 $2.80,Gemini 3.1 Flash Lite 合计 $1.75——在这个配比下 Gemini 3.1 Flash Lite 约便宜 37%。真实负载通常严重偏向输入 tokens,请按你自己的输入/输出比例衡量;上表的「缓存输入」一行是该模型的目录公示价。

在 Gemini 3.5 Flash Lite 与 Gemini 3.1 Flash Lite 之间切换

API Key、base URL 和端点都不变——Router One 在 /v1/chat/completions 上提供这两个模型——但按 Google 的 Gemini 3.6 Flash 与 3.5 Flash-Lite 指南(2026-10-09 核对),从这两个模型起,Gemini API 忽略 temperature、top_p 与 top_k,并拒绝最后一轮是预填 model 轮的请求,Gemini 3.5 Flash Lite 的默认思考级别是 minimal;Gemini 3.1 Flash Lite 早于这些改动。切换前把语气与格式要求写进 system 消息,再用自己的 prompt 对比两者。

compare.sh
curl https://api.router.one/v1/chat/completions \
  -H "Authorization: Bearer sk-your-router-one-key" \
  -H "Content-Type: application/json" \
  -d '{"model": "google/gemini-3.5-flash-lite", "messages": [{"role": "user", "content": "Hello"}]}'

# 同一请求换模型,只改一个字符串:
#   "model": "google/gemini-3.1-flash-lite"

常见问题

Gemini 3.5 Flash Lite 比 Gemini 3.1 Flash Lite 便宜吗?

输入:Gemini 3.5 Flash Lite $0.30 vs Gemini 3.1 Flash Lite $0.25 / 1M tokens,Gemini 3.1 Flash Lite 更低。输出:Gemini 3.5 Flash Lite $2.50 vs Gemini 3.1 Flash Lite $1.50 / 1M tokens,Gemini 3.1 Flash Lite 更低。实际总成本取决于输入、输出和缓存的用量配比。价格会变化;/models 页面是实时来源。

Gemini 3.5 Flash Lite 和 Gemini 3.1 Flash Lite 包含在 Router One 套餐里吗?

Gemini 3.5 Flash Lite 和 Gemini 3.1 Flash Lite 都不在任何 Router One 套餐内,每次调用都按钱包余额计费。

在 Gemini 3.5 Flash Lite 和 Gemini 3.1 Flash Lite 之间切换要改代码吗?

API Key、base URL 和端点都不变——Router One 在 /v1/chat/completions 上提供这两个模型——但按 Google 的 Gemini 3.6 Flash 与 3.5 Flash-Lite 指南(2026-10-09 核对),从这两个模型起,Gemini API 忽略 temperature、top_p 与 top_k,并拒绝最后一轮是预填 model 轮的请求,Gemini 3.5 Flash Lite 的默认思考级别是 minimal;Gemini 3.1 Flash Lite 早于这些改动。切换前把语气与格式要求写进 system 消息,再用自己的 prompt 对比两者。

这些数字从哪来?

本页的规格和价格直接渲染自 Router One 实时模型目录——与 /models 页同源,并随之刷新。定价方法见 /pricing-methodology。本页价格于 2026-10-09(UTC)读取自实时目录,一小时内自动刷新。

更多对比