Grok 4.7 vs Gemini 3.8 Flash
下列单价及 1M 输入 + 1M 输出的合计示例使用基础阶梯,假设每次请求满足:grok-4.7: 单次请求输入 ≤ 200,000 tokens。超过门槛时按下方长上下文阶梯计费。Gemini 3.8 Flash 在 Router One 上更便宜——按 1M 输入 + 1M 输出的配比约低 69%。Grok 4.7 上下文 500K,Gemini 3.8 Flash 为 1.05M。Grok 4.7 可走 /v1/chat/completions、/v1/responses(Codex CLI);Gemini 3.8 Flash 可走 /v1/chat/completions。
Grok 4.7 与 Gemini 3.8 Flash 的当前单价、上下文窗口与能力对比——两者都能通过同一个 OpenAI 兼容端点调用,每次请求带成本 trace。
Grok 4.7 与 Gemini 3.8 Flash:单价、上下文窗口与能力对比
| 规格 | Grok 4.7 | Gemini 3.8 Flash |
|---|---|---|
| 输入 / 1M tokens | $1.10 | $0.225 |
| 输出 / 1M tokens | $3.30 | $1.125 |
| 缓存输入 / 1M tokens | $0.275 | $0.225 |
| 上下文窗口 | 500K | 1.05M |
| 详情页 | Grok 4.7 | Gemini 3.8 Flash |
grok-4.7:单次请求输入 ≤ 200,000 tokens:输入 $1.10 / 1M tokens,输出 $3.30 / 1M tokens,缓存写入 $1.10 / 1M tokens,缓存输入 $0.275 / 1M tokens;单次请求输入 > 200,000 tokens:输入 $2.20 / 1M tokens,输出 $6.60 / 1M tokens,缓存写入 $2.20 / 1M tokens,缓存输入 $0.55 / 1M tokens。按单次请求的总输入 token 数选择阶梯,整次请求适用该阶梯的费率,并非只对超出部分加价。
Grok 4.7 与 Gemini 3.8 Flash 跑 1M tokens 各要多少钱?
下列单价及 1M 输入 + 1M 输出的合计示例使用基础阶梯,假设每次请求满足:grok-4.7: 单次请求输入 ≤ 200,000 tokens。超过门槛时按下方长上下文阶梯计费。按当前单价计算 1M 输入 + 1M 输出 tokens 的负载:Grok 4.7 合计 $4.40,Gemini 3.8 Flash 合计 $1.35——在这个配比下 Gemini 3.8 Flash 约便宜 69%。真实负载通常严重偏向输入 tokens,请按你自己的输入/输出比例衡量;上表的「缓存输入」一行是该模型的目录公示价。
在 Grok 4.7 与 Gemini 3.8 Flash 之间切换,不改代码
两个模型都在同一个 OpenAI 兼容端点后面,A/B 测试只是改一个 model 字符串——key、base URL、请求结构都不变,每次请求的 tokens、花费、延迟都记录在控制台:
curl https://api.router.one/v1/chat/completions \
-H "Authorization: Bearer sk-your-router-one-key" \
-H "Content-Type: application/json" \
-d '{"model": "grok-4.7", "messages": [{"role": "user", "content": "Hello"}]}'
# Same request, other model — change one string:
# "model": "google/gemini-3.8-flash"常见问题
Grok 4.7 比 Gemini 3.8 Flash 便宜吗?
下列单价及 1M 输入 + 1M 输出的合计示例使用基础阶梯,假设每次请求满足:grok-4.7: 单次请求输入 ≤ 200,000 tokens。超过门槛时按下方长上下文阶梯计费。输入:Grok 4.7 $1.10 vs Gemini 3.8 Flash $0.225 / 1M tokens,Gemini 3.8 Flash 更低。输出:Grok 4.7 $3.30 vs Gemini 3.8 Flash $1.125 / 1M tokens,Gemini 3.8 Flash 更低。实际总成本取决于输入、输出和缓存的用量配比。grok-4.7:单次请求输入 ≤ 200,000 tokens:输入 $1.10 / 1M tokens,输出 $3.30 / 1M tokens,缓存写入 $1.10 / 1M tokens,缓存输入 $0.275 / 1M tokens;单次请求输入 > 200,000 tokens:输入 $2.20 / 1M tokens,输出 $6.60 / 1M tokens,缓存写入 $2.20 / 1M tokens,缓存输入 $0.55 / 1M tokens。按单次请求的总输入 token 数选择阶梯,整次请求适用该阶梯的费率,并非只对超出部分加价。价格会变化;/models 页面是实时来源。
在 Grok 4.7 和 Gemini 3.8 Flash 之间切换要改代码吗?
不用。两者走同一个 OpenAI 兼容端点,切换就是改请求里的 model 字符串——key、base URL、请求结构完全不变。
这些数字从哪来?
本页的规格和价格直接渲染自 Router One 实时模型目录——与 /models 页同源,并随之刷新。定价方法见 /pricing-methodology。本页价格于 2026-09-22(UTC)读取自实时目录,一小时内自动刷新。