Gemini 3.5 Flash Lite vs Gemini 3.5 Flash
Gemini 3.5 Flash Lite 在 Router One 上更便宜——按 1M 输入 + 1M 输出的配比约低 11%。两者上下文窗口同为 1.05M。两者都可走 /v1/chat/completions。Gemini 3.5 Flash Lite 不在任何套餐内,按钱包余额计费;Gemini 3.5 Flash 计入 Pro、Max、Ultra 的普通模型额度。
Gemini 3.5 Flash Lite 与 Gemini 3.5 Flash 的当前单价、上下文窗口与能力对比——两者都能通过同一个 OpenAI 兼容端点调用,每次请求带成本 trace。
Gemini 3.5 Flash Lite 与 Gemini 3.5 Flash:单价、上下文 窗口与 能力 对比
| 规格 | Gemini 3.5 Flash Lite | Gemini 3.5 Flash |
|---|---|---|
| 输入 / 1M tokens | $0.30 | $0.45 |
| 输出 / 1M tokens | $2.50 | $2.70 |
| 缓存输入 / 1M tokens | $0.30 | $0.45 |
| 上下文窗口 | 1.05M | 1.05M |
| 能力 | 对话、流式输出、工具调用、视觉理解 | 对话、流式输出、工具调用、视觉理解 |
| 套餐覆盖 | 不在任何套餐 — 钱包计费 | 普通模型 — Pro、Max、Ultra |
| 详情页 | Gemini 3.5 Flash Lite | Gemini 3.5 Flash |
Gemini 3.5 Flash Lite 与 Gemini 3.5 Flash 跑 1M tokens 各要 多少钱?
按当前单价计算 1M 输入 + 1M 输出 tokens 的负载:Gemini 3.5 Flash Lite 合计 $2.80,Gemini 3.5 Flash 合计 $3.15——在这个配比下 Gemini 3.5 Flash Lite 约便宜 11%。真实负载通常严重偏向输入 tokens,请按你自己的输入/输出比例衡量;上表的「缓存输入」一行是该模型的目录公示价。
在 Gemini 3.5 Flash Lite 与 Gemini 3.5 Flash 之间 切换
API Key、base URL 和端点都不变——Router One 在 /v1/chat/completions 上提供这两个模型——但按 Google 的 Gemini 3.6 Flash 与 3.5 Flash-Lite 指南(2026-10-09 核对),从这两个模型起,Gemini API 忽略 temperature、top_p 与 top_k,并拒绝最后一轮是预填 model 轮的请求,Gemini 3.5 Flash Lite 的默认思考级别是 minimal;Gemini 3.5 Flash 早于这些改动。切换前把语气与格式要求写进 system 消息,再用自己的 prompt 对比两者。
curl https://api.router.one/v1/chat/completions \
-H "Authorization: Bearer sk-your-router-one-key" \
-H "Content-Type: application/json" \
-d '{"model": "google/gemini-3.5-flash-lite", "messages": [{"role": "user", "content": "Hello"}]}'
# 同一请求换模型,只改一个字符串:
# "model": "google/gemini-3.5-flash"常见问题
Gemini 3.5 Flash Lite 比 Gemini 3.5 Flash 便宜吗?
输入:Gemini 3.5 Flash Lite $0.30 vs Gemini 3.5 Flash $0.45 / 1M tokens,Gemini 3.5 Flash Lite 更低。输出:Gemini 3.5 Flash Lite $2.50 vs Gemini 3.5 Flash $2.70 / 1M tokens,Gemini 3.5 Flash Lite 更低。实际总成本取决于输入、输出和缓存的用量配比。价格会变化;/models 页面是实时来源。
Gemini 3.5 Flash Lite 和 Gemini 3.5 Flash 包含在 Router One 套餐里吗?
Gemini 3.5 Flash Lite 不在任何 Router One 套餐内,每次调用都按钱包余额计费。Gemini 3.5 Flash 计入 Pro、Max、Ultra 的普通模型额度:Pro 5,000 次、Max 8,000 次、Ultra 25,000 次(每 30 天周期),同一层级的模型共享。Gemini 3.5 Flash 输入超过长上下文阈值的请求按多次扣额度。超出套餐额度的请求按钱包余额计费。
在 Gemini 3.5 Flash Lite 和 Gemini 3.5 Flash 之间 切换要 改代码吗?
API Key、base URL 和端点都不变——Router One 在 /v1/chat/completions 上提供这两个模型——但按 Google 的 Gemini 3.6 Flash 与 3.5 Flash-Lite 指南(2026-10-09 核对),从这两个模型起,Gemini API 忽略 temperature、top_p 与 top_k,并拒绝最后一轮是预填 model 轮的请求,Gemini 3.5 Flash Lite 的默认思考级别是 minimal;Gemini 3.5 Flash 早于这些改动。切换前把语气与格式要求写进 system 消息,再用自己的 prompt 对比两者。
这些 数字从 哪来?
本页的规格和价格直接渲染自 Router One 实时模型目录——与 /models 页同源,并随之刷新。定价方法见 /pricing-methodology。本页价格于 2026-10-09(UTC)读取自实时目录,一小时内自动刷新。