跳到主要内容
Router One
返回模型广场
长上下文

deepseek-v4-flash API 价格

DeepSeek 系列:高性价比的推理与编码模型。

模型 IDdeepseek-v4-flash
对话流式输出工具调用

调用摘要

输入
$0.60/ 1M tokens
缓存写入 $0.60
输出
$2.40/ 1M tokens
缓存读取 $0.012
上下文窗口
1M
API 端点
3

deepseek-v4-flash 的 API 端点

一个 API Key,即可通过以下 3 个端点调用该模型。

POST/v1/chat/completionsOpenAI 兼容 · 全模型通用
POST/v1/messagesAnthropic 原生 · Claude Code 直连
POST/v1/responsesResponses API · Codex CLI 直连

生产可靠性

基于 Router One 真实模型调用的脱敏聚合数据,帮助你在接入前判断稳定性与响应延迟。

成功响应占比

98.99%

成功 2xx

98.99%

限流 429

1.01%

服务端 5xx

0.00%

TPS

125.23

tokens/s
平均首 Token 延迟

6.2 s

平均延迟

10.43 s

只统计最终状态为 2xx、429 或 5xx 的生产请求;平均延迟基于成功请求,首 Token 延迟和 TPS 仅基于具有完整流式观测的成功请求。公开门槛为 100 次请求和 5 个独立主体。

更新于 2026年9月20日 12:44 UTC

Router One 上更多 DeepSeek 系列模型

同一网关、同一把 API Key 下还有 1 个 DeepSeek 系列模型;每页列出端点、公示价格与上下文窗口。

deepseek-v4-flash 速览

deepseek-v4-flash 是 Router One 上的 DeepSeek 系列文本模型。公示价:输入 $0.60 / 输出 $2.40(每 1M tokens)。上下文窗口:1M tokens。输入 文本,输出 文本。端点(共 3 个):POST /v1/chat/completions(OpenAI 兼容)、POST /v1/messages(Anthropic 原生,Claude Code 直连路径)、POST /v1/responses(Responses API,Codex CLI 直连路径)。

deepseek-v4-flash 常见问题

deepseek-v4-flash 在 Router One 上多少钱?

deepseek-v4-flash 在 Router One 上按 token 计费:输入 $0.60 / 输出 $2.40(每 1M tokens),按量付费。

deepseek-v4-flash 支持哪些端点?

deepseek-v4-flash 支持 3 个端点:POST /v1/chat/completions(OpenAI 兼容)、POST /v1/messages(Anthropic 原生,Claude Code 直连路径)、POST /v1/responses(Responses API,Codex CLI 直连路径);同一把 Router One API Key 均可调用。

deepseek-v4-flash 的上下文窗口多大?

deepseek-v4-flash 在 Router One 上的上下文窗口为 1M tokens(单次请求)。

开始使用 deepseek-v4-flash

创建 API Key 即可在 Router One 调用 deepseek-v4-flash(输入 $0.60 / 输出 $2.40 每 1M tokens)——按量计费,每次请求的成本与延迟都有账可查。