调用摘要
适用于单次请求输入 ≤ 200,000 tokens · 查看分档价格
Grok 4.6 的 API 端点
一个 API Key,即可通过以下 2 个端点调用该模型。
Grok 4.6 的分档价格
价格按单次请求的输入长度(含缓存)分档,超过阈值后整个请求按对应档位计费;下表单价均为每 1M tokens。
| 档位 | 输入 | 输出 |
|---|---|---|
标准≤ 200K | $2.20$1.10缓存写入: $1.10缓存读取: $0.275 | $6.60$3.30 |
长上下文> 200K | $4.40$2.20缓存写入: $2.20缓存读取: $0.55 | $13.20$6.60 |
生产可靠性
基于 Router One 真实模型调用的脱敏聚合数据,帮助你在接入前判断稳定性与响应延迟。
94.06%
94.06%
0.00%
5.94%
53.14
tokens/s7.66 s
37.7 s
只统计最终状态为 2xx、429 或 5xx 的生产请求;平均延迟基于成功请求,首字延迟和 TPS 仅基于具有完整流式观测的成功请求。公开门槛为 100 次请求和 5 个独立主体。
更新于 2026年9月30日 07:49 UTC
Router One 上更多 Grok 系列模型
同一网关、同一把 API Key 下还有 7 个 Grok 系列模型;每页列出端点、公示价格与上下文窗口。
Grok 4.6 与其他模型的对比
同价位与跨系列的规格价格对比。
Grok 4.6 速览
Grok 4.6(模型 ID:grok-4.6)是 Router One 上的 Grok 系列文本模型。单次请求输入 ≤ 200,000 tokens:输入 $1.10 / 1M tokens,输出 $3.30 / 1M tokens,缓存写入 $1.10 / 1M tokens,缓存输入 $0.275 / 1M tokens;单次请求输入 > 200,000 tokens:输入 $2.20 / 1M tokens,输出 $6.60 / 1M tokens,缓存写入 $2.20 / 1M tokens,缓存输入 $0.55 / 1M tokens。按单次请求的总输入 token 数选择阶梯,整次请求适用该阶梯的费率,并非只对超出部分加价。Router One 订阅在中级模型额度中包含 Grok 4.6:Pro 1,200 次、Max 4,500 次、Ultra 15,000 次(每 30 天周期)。超出额度的用量按公示单价从钱包扣费。在套餐额度内,单次输入超过 200,000 tokens 的请求按 2 次计。上下文窗口:500K tokens。端点(共 2 个):POST /v1/chat/completions(OpenAI 兼容)、POST /v1/responses(Responses API,Codex CLI 直连路径)。
Grok 4.6 常见 问题
Grok 4.6 在 Router One 上多少钱?
单次请求输入 ≤ 200,000 tokens:输入 $1.10 / 1M tokens,输出 $3.30 / 1M tokens,缓存写入 $1.10 / 1M tokens,缓存输入 $0.275 / 1M tokens;单次请求输入 > 200,000 tokens:输入 $2.20 / 1M tokens,输出 $6.60 / 1M tokens,缓存写入 $2.20 / 1M tokens,缓存输入 $0.55 / 1M tokens。按单次请求的总输入 token 数选择阶梯,整次请求适用该阶梯的费率,并非只对超出部分加价。
Router One 订阅 套餐 包含 Grok 4.6 吗?
Router One 订阅在中级模型额度中包含 Grok 4.6:Pro 1,200 次、Max 4,500 次、Ultra 15,000 次(每 30 天周期)。超出额度的用量按公示单价从钱包扣费。在套餐额度内,单次输入超过 200,000 tokens 的请求按 2 次计。
Grok 4.6 支持 哪些 端点?
Grok 4.6 支持 2 个端点:POST /v1/chat/completions(OpenAI 兼容)、POST /v1/responses(Responses API,Codex CLI 直连路径);同一把 Router One API Key 均可调用。
Grok 4.6 的上下文 窗口 多大?
Grok 4.6 在 Router One 上的上下文窗口为 500K tokens(单次请求)。
开始 使用 Grok 4.6
创建 API Key 即可在 Router One 调用 Grok 4.6(单次请求输入 ≤ 200,000 tokens:输入 $1.10 / 输出 $3.30 每 1M tokens)——按量计费,每次请求的成本与延迟都有账可查。