Router One

GPT-5.6 Luna vs Gemini 3.6 Flash

GPT-5.6 Luna 与 Gemini 3.6 Flash 的当前单价、上下文窗口与能力对比——两者都能通过同一个 OpenAI 兼容端点调用,每次请求带成本 trace。

GPT-5.6 Luna 与 Gemini 3.6 Flash:单价、上下文窗口与能力对比

规格GPT-5.6 LunaGemini 3.6 Flash
输入 / 1M tokens$0.10$0.45
输出 / 1M tokens$0.60$2.70
缓存输入 / 1M tokens$0.05$0.45
上下文窗口1.1M1.0M
能力对话, 流式输出, 工具调用, 视觉理解
详情页GPT-5.6 LunaGemini 3.6 Flash

GPT-5.6 Luna 与 Gemini 3.6 Flash 跑 1M tokens 各要多少钱?

按当前单价计算 1M 输入 + 1M 输出 tokens 的负载:GPT-5.6 Luna 合计 $0.70,Gemini 3.6 Flash 合计 $3.15——在这个配比下 GPT-5.6 Luna 约便宜 78%。真实负载通常严重偏向输入 tokens,请按你自己的输入/输出比例衡量;支持提示词缓存的模型,缓存命中按缓存输入价计费。

在 GPT-5.6 Luna 与 Gemini 3.6 Flash 之间切换,不改代码

两个模型都在同一个 OpenAI 兼容端点后面,A/B 测试只是改一个 model 字符串——key、base URL、请求结构都不变,每次请求的 tokens、花费、延迟都记录在控制台:

compare.sh
curl https://api.router.one/v1/chat/completions \
  -H "Authorization: Bearer sk-your-router-one-key" \
  -H "Content-Type: application/json" \
  -d '{"model": "openai/gpt-5.6-luna", "messages": [{"role": "user", "content": "Hello"}]}'

# Same request, other model — change one string:
#   "model": "google/gemini-3.6-flash"

常见问题

GPT-5.6 Luna 比 Gemini 3.6 Flash 便宜吗?

按当前公示单价,GPT-5.6 Luna 更便宜(输入 $0.10 vs $0.45,输出 $0.60 vs $2.70,均为每 1M tokens)。价格会调整,/models 页是实时的事实来源。

在 GPT-5.6 Luna 和 Gemini 3.6 Flash 之间切换要改代码吗?

不用。两者走同一个 OpenAI 兼容端点,切换就是改请求里的 model 字符串——key、base URL、请求结构完全不变。

这些数字从哪来?

本页的规格和价格直接渲染自 Router One 实时模型目录——与 /models 页同源,并随之刷新。定价方法见 /pricing-methodology。