跳到主要内容
Router One
返回模型广场
长上下文

gemini-3-flash-preview API 价格

Google 的 Gemini 系列:超长上下文与多模态输入见长。

模型 IDgoogle/gemini-3-flash-preview

调用摘要

输入
$1.7143$1.20/ 1M tokens
缓存写入 $1.20
输出
$11.4286$8.00/ 1M tokens
缓存读取 $1.20
上下文窗口
1.05M
API 端点
1
可用配置
1

gemini-3-flash-preview 的 API 端点

一个 API Key,即可通过以下 1 个端点调用该模型。

POST/v1/chat/completionsOpenAI 兼容 · 全模型通用

生产可靠性

基于 Router One 真实模型调用的脱敏聚合数据,帮助你在接入前判断稳定性与响应延迟。

成功响应占比

99.66%

成功 2xx

99.66%

限流 429

0.22%

服务端 5xx

0.11%

TPS

1,825.04

tokens/s
平均首 Token 延迟

5.31 s

平均延迟

6.37 s

只统计最终状态为 2xx、429 或 5xx 的生产请求;平均延迟基于成功请求,首 Token 延迟和 TPS 仅基于具有完整流式观测的成功请求。公开门槛为 100 次请求和 5 个独立主体。

更新于 2026年9月9日 20:59 UTC

Router One 上更多 Gemini 系列模型

同一网关、同一把 API Key 下还有 11 个 Gemini 系列模型;每页列出端点、公示价格与上下文窗口。

gemini-3-flash-preview 速览

gemini-3-flash-preview 是 Router One 上的 Gemini 系列文本模型。gemini-3-flash-preview 是预览版 ID;正式版 ID gemini-3-flash 单独上架、单独定价。公示价:输入 $1.20 / 输出 $8.00(每 1M tokens;原价输入 $1.7143 / 输出 $11.4286)。上下文窗口:1.05M tokens。输入 文本、图像,输出 文本。端点(共 1 个):POST /v1/chat/completions(OpenAI 兼容)。

gemini-3-flash-preview 常见问题

gemini-3-flash-preview 在 Router One 上多少钱?

gemini-3-flash-preview 在 Router One 上按 token 计费:输入 $1.20 / 输出 $8.00(每 1M tokens),按量付费。

gemini-3-flash-preview 支持哪些端点?

gemini-3-flash-preview 支持 1 个端点:POST /v1/chat/completions(OpenAI 兼容);同一把 Router One API Key 均可调用。

gemini-3-flash-preview 的上下文窗口多大?

gemini-3-flash-preview 在 Router One 上的上下文窗口为 1.05M tokens(单次请求)。

开始使用 gemini-3-flash-preview

创建 API Key 即可在 Router One 调用 gemini-3-flash-preview(输入 $1.20 / 输出 $8.00 每 1M tokens)——按量计费,每次请求的成本与延迟都有账可查。