跳到主要内容
Router One
返回模型广场
长上下文

gpt-6-astra · Azure API 价格

OpenAI 的 GPT 系列:通用能力全面、生态广泛,Codex CLI 的原生模型。

模型 IDazure/gpt-6-astra
对话流式输出工具调用视觉理解

调用摘要

输入
$10.00$7.00/ 1M tokens
缓存写入 $8.75
输出
$50.00$35.00/ 1M tokens
缓存读取 $0.70
上下文窗口
1.05M
API 端点
2

gpt-6-astra · Azure 的 API 端点

一个 API Key,即可通过以下 2 个端点调用该模型。

POST/v1/chat/completionsOpenAI 兼容 · 全模型通用
POST/v1/responsesResponses API · Codex CLI 直连

gpt-6-astra · Azure 的分档价格

价格按单次请求的输入长度(含缓存)分档,超过阈值后整个请求按对应档位计费;下表单价均为每 1M tokens。

档位
标准≤ 272K
输入
$10.00$7.00缓存写入: $8.75
输出
$50.00$35.00缓存读取: $0.70
档位
长上下文> 272K
输入
$20.00$14.00缓存写入: $17.50
输出
$75.00$52.50缓存读取: $1.40

生产可靠性

基于 Router One 真实模型调用的脱敏聚合数据,帮助你在接入前判断稳定性与响应延迟。

生产样本暂时不足

该统计窗口至少需要 100 次有效请求和 5 个独立主体;达到门槛后会自动展示。

Router One 上更多 GPT 系列模型

同一网关、同一把 API Key 下还有 12 个 GPT 系列模型;每页列出端点、公示价格与上下文窗口。

gpt-6-astra · Azure 速览

gpt-6-astra · Azure 是 Router One 上的 GPT 系列文本模型。单次请求输入 ≤ 272,000 tokens:输入 $7.00 / 1M tokens,输出 $35.00 / 1M tokens,缓存写入 $8.75 / 1M tokens,缓存输入 $0.70 / 1M tokens;单次请求输入 > 272,000 tokens:输入 $14.00 / 1M tokens,输出 $52.50 / 1M tokens,缓存写入 $17.50 / 1M tokens,缓存输入 $1.40 / 1M tokens。按单次请求的总输入 token 数选择阶梯,整次请求适用该阶梯的费率,并非只对超出部分加价。上下文窗口:1.05M tokens。输入 文本、图像,输出 文本。端点(共 2 个):POST /v1/chat/completions(OpenAI 兼容)、POST /v1/responses(Responses API,Codex CLI 直连路径)。

gpt-6-astra · Azure 常见问题

gpt-6-astra · Azure 在 Router One 上多少钱?

单次请求输入 ≤ 272,000 tokens:输入 $7.00 / 1M tokens,输出 $35.00 / 1M tokens,缓存写入 $8.75 / 1M tokens,缓存输入 $0.70 / 1M tokens;单次请求输入 > 272,000 tokens:输入 $14.00 / 1M tokens,输出 $52.50 / 1M tokens,缓存写入 $17.50 / 1M tokens,缓存输入 $1.40 / 1M tokens。按单次请求的总输入 token 数选择阶梯,整次请求适用该阶梯的费率,并非只对超出部分加价。

gpt-6-astra · Azure 支持哪些端点?

gpt-6-astra · Azure 支持 2 个端点:POST /v1/chat/completions(OpenAI 兼容)、POST /v1/responses(Responses API,Codex CLI 直连路径);同一把 Router One API Key 均可调用。

gpt-6-astra · Azure 的上下文窗口多大?

gpt-6-astra · Azure 在 Router One 上的上下文窗口为 1.05M tokens(单次请求)。

开始使用 gpt-6-astra · Azure

创建 API Key 即可在 Router One 调用 gpt-6-astra · Azure(单次请求输入 ≤ 272,000 tokens:输入 $7.00 / 输出 $35.00 每 1M tokens)——按量计费,每次请求的成本与延迟都有账可查。