GPT-5.6 Luna vs Gemini 3.6 Flash
GPT-5.6 Luna 与 Gemini 3.6 Flash 的当前单价、上下文窗口与能力对比——两者都能通过同一个 OpenAI 兼容端点调用,每次请求带成本 trace。
GPT-5.6 Luna 与 Gemini 3.6 Flash:单价、上下文窗口与能力对比
| 规格 | GPT-5.6 Luna | Gemini 3.6 Flash |
|---|---|---|
| 输入 / 1M tokens | $0.10 | $0.45 |
| 输出 / 1M tokens | $0.60 | $2.70 |
| 缓存输入 / 1M tokens | $0.05 | $0.45 |
| 上下文窗口 | 1.1M | 1.0M |
| 能力 | 对话, 流式输出, 工具调用, 视觉理解 | — |
| 详情页 | GPT-5.6 Luna | Gemini 3.6 Flash |
GPT-5.6 Luna 与 Gemini 3.6 Flash 跑 1M tokens 各要多少钱?
按当前单价计算 1M 输入 + 1M 输出 tokens 的负载:GPT-5.6 Luna 合计 $0.70,Gemini 3.6 Flash 合计 $3.15——在这个配比下 GPT-5.6 Luna 约便宜 78%。真实负载通常严重偏向输入 tokens,请按你自己的输入/输出比例衡量;支持提示词缓存的模型,缓存命中按缓存输入价计费。
在 GPT-5.6 Luna 与 Gemini 3.6 Flash 之间切换,不改代码
两个模型都在同一个 OpenAI 兼容端点后面,A/B 测试只是改一个 model 字符串——key、base URL、请求结构都不变,每次请求的 tokens、花费、延迟都记录在控制台:
compare.sh
curl https://api.router.one/v1/chat/completions \
-H "Authorization: Bearer sk-your-router-one-key" \
-H "Content-Type: application/json" \
-d '{"model": "openai/gpt-5.6-luna", "messages": [{"role": "user", "content": "Hello"}]}'
# Same request, other model — change one string:
# "model": "google/gemini-3.6-flash"常见问题
GPT-5.6 Luna 比 Gemini 3.6 Flash 便宜吗?
按当前公示单价,GPT-5.6 Luna 更便宜(输入 $0.10 vs $0.45,输出 $0.60 vs $2.70,均为每 1M tokens)。价格会调整,/models 页是实时的事实来源。
在 GPT-5.6 Luna 和 Gemini 3.6 Flash 之间切换要改代码吗?
不用。两者走同一个 OpenAI 兼容端点,切换就是改请求里的 model 字符串——key、base URL、请求结构完全不变。
这些数字从哪来?
本页的规格和价格直接渲染自 Router One 实时模型目录——与 /models 页同源,并随之刷新。定价方法见 /pricing-methodology。