跳到主要内容
Router One

Grok 4.6 vs Claude Sonnet 5

下列单价及 1M 输入 + 1M 输出的合计示例使用基础阶梯,假设每次请求满足:grok-4.6: 单次请求输入 ≤ 200,000 tokens。超过门槛时按下方长上下文阶梯计费。Grok 4.6 按 1M 输入 + 1M 输出配比约低 19%,但 Claude Sonnet 5 的输入单价更低——真实负载偏向输入。Grok 4.6 上下文 500K,Claude Sonnet 5 为 1.05M。Grok 4.6 可走 /v1/chat/completions;Claude Sonnet 5 可走 /v1/chat/completions、/v1/messages(Claude Code)。

Grok 4.6 与 Claude Sonnet 5 的当前单价、上下文窗口与能力对比——两者都能通过同一个 OpenAI 兼容端点调用,每次请求带成本 trace。

Grok 4.6 与 Claude Sonnet 5:单价、上下文窗口与能力对比

规格Grok 4.6Claude Sonnet 5
输入 / 1M tokens$1.10$0.90
输出 / 1M tokens$3.30$4.50
缓存输入 / 1M tokens$0.275$0.15
上下文窗口500K1.05M
能力对话、流式输出、工具调用、视觉理解对话、流式输出、工具调用、视觉理解
详情页Grok 4.6Claude Sonnet 5

grok-4.6:单次请求输入 ≤ 200,000 tokens:输入 $1.10 / 1M tokens,输出 $3.30 / 1M tokens,缓存写入 $1.10 / 1M tokens,缓存输入 $0.275 / 1M tokens;单次请求输入 > 200,000 tokens:输入 $2.20 / 1M tokens,输出 $6.60 / 1M tokens,缓存写入 $2.20 / 1M tokens,缓存输入 $0.55 / 1M tokens。按单次请求的总输入 token 数选择阶梯,整次请求适用该阶梯的费率,并非只对超出部分加价。

Grok 4.6 与 Claude Sonnet 5 跑 1M tokens 各要多少钱?

下列单价及 1M 输入 + 1M 输出的合计示例使用基础阶梯,假设每次请求满足:grok-4.6: 单次请求输入 ≤ 200,000 tokens。超过门槛时按下方长上下文阶梯计费。按当前单价计算 1M 输入 + 1M 输出 tokens 的负载:Grok 4.6 合计 $4.40,Claude Sonnet 5 合计 $5.40——在这个配比下 Grok 4.6 约便宜 19%。真实负载通常严重偏向输入 tokens,请按你自己的输入/输出比例衡量;上表的「缓存输入」一行是该模型的目录公示价。

在 Grok 4.6 与 Claude Sonnet 5 之间切换,不改代码

两个模型都在同一个 OpenAI 兼容端点后面,A/B 测试只是改一个 model 字符串——key、base URL、请求结构都不变,每次请求的 tokens、花费、延迟都记录在控制台:

compare.sh
curl https://api.router.one/v1/chat/completions \
  -H "Authorization: Bearer sk-your-router-one-key" \
  -H "Content-Type: application/json" \
  -d '{"model": "grok-4.6", "messages": [{"role": "user", "content": "Hello"}]}'

# Same request, other model — change one string:
#   "model": "anthropic/claude-sonnet-5"

常见问题

Grok 4.6 比 Claude Sonnet 5 便宜吗?

下列单价及 1M 输入 + 1M 输出的合计示例使用基础阶梯,假设每次请求满足:grok-4.6: 单次请求输入 ≤ 200,000 tokens。超过门槛时按下方长上下文阶梯计费。输入:Grok 4.6 $1.10 vs Claude Sonnet 5 $0.90 / 1M tokens,Claude Sonnet 5 更低。输出:Grok 4.6 $3.30 vs Claude Sonnet 5 $4.50 / 1M tokens,Grok 4.6 更低。实际总成本取决于输入、输出和缓存的用量配比。grok-4.6:单次请求输入 ≤ 200,000 tokens:输入 $1.10 / 1M tokens,输出 $3.30 / 1M tokens,缓存写入 $1.10 / 1M tokens,缓存输入 $0.275 / 1M tokens;单次请求输入 > 200,000 tokens:输入 $2.20 / 1M tokens,输出 $6.60 / 1M tokens,缓存写入 $2.20 / 1M tokens,缓存输入 $0.55 / 1M tokens。按单次请求的总输入 token 数选择阶梯,整次请求适用该阶梯的费率,并非只对超出部分加价。价格会变化;/models 页面是实时来源。

在 Grok 4.6 和 Claude Sonnet 5 之间切换要改代码吗?

不用。两者走同一个 OpenAI 兼容端点,切换就是改请求里的 model 字符串——key、base URL、请求结构完全不变。

这些数字从哪来?

本页的规格和价格直接渲染自 Router One 实时模型目录——与 /models 页同源,并随之刷新。定价方法见 /pricing-methodology。本页价格于 2026-09-20(UTC)读取自实时目录,一小时内自动刷新。

更多对比