> https://router.one/zh/blog/image-generation-api-china-guide 的 Markdown 镜像，供 AI 助手与爬虫使用。Router One 是 OpenAI 兼容的统一 LLM API 网关。
> 发布：2026-07-18 · 修订：2026-09-01 · 作者：Router One Team

# 国内调用生图与视频 API 完整指南：gpt-image-2、Nano Banana、Vidu

_2026 年 8 月国内开发者指南：gpt-image-2、Gemini 3 Pro Image、豆包 Seedream 生图，视频生成按目录在售模型调用——免翻墙、无需境外卡、按张/按条计价。_

文生图和视频生成模型已经强到可以进真实产品了——营销素材流水线、电商主图、游戏资产、短视频。但国内开发者面临的门槛也熟悉：最强的模型都挂在要境外卡的计费页后面，端点还对大陆网络不稳定甚至不可达。

这篇指南讲 2026 年 8 月真正跑得通的路径：用 gpt-image-2、Gemini 3 Pro Image（社区常搜的 "Nano Banana"）、Gemini 3.1 Flash Image、豆包 Seedream、Grok Imagine 生图，用 Vidu Q3 Turbo、PixVerse、MiniMax Hailuo、通义万相 2.6 生成视频——一把网关 Key，人民币付费。

## 先说访问问题

每家主流生图/视频模型都有自己的门：

- **gpt-image-2** 挂在 OpenAI 平台账号下，绑卡要大陆银行基本发不了的卡。
- **Gemini 3 Pro Image 和 Gemini 3.1 Flash Image** 在谷歌端点后面，大陆访问被屏蔽或不稳定，还要 Google Cloud 计费。
- **Grok Imagine** 需要国内团队大多没有的 xAI 账号和计费关系。
- **视频模型**各有各的控制台、账号和充值流程——同时用四家，就是四套对接、四个余额要盯。

[Router One](https://router.one/zh) 把它们都放在国内可直连的网关后面：一把 Key、一个支付宝或银行卡可充值的钱包、每次生成都有成本 trace。产品页覆盖端点全貌——[生图 API](https://router.one/zh/image-generation-api) 和 [视频生成 API](https://router.one/zh/veo-api-china)——这篇是上手实操。

## 目录里有什么（2026 年 8 月快照）

媒体模型按件计价：一张图/一条视频一个固定美元单价，不算 token 账。视频的时长和分辨率按模型锁死——固定单价才立得住。以下是写作时的快照——实时价格永远以 [router.one/models](https://router.one/zh/models) 为准：

| 模型 | 类型 | 固定规格 | 单价 |
| --- | --- | --- | --- |
| gpt-image-2 | 图像 | — | $0.50 / 张 |
| gemini-3-pro-image-preview | 图像 | — | $0.50 / 张 |
| gemini-3.1-flash-image-preview | 图像 | — | $0.50 / 张 |
| doubao-seedream-5-0-260128 | 图像 | — | $0.50 / 张 |
| grok-imagine-image | 图像 | — | $0.50 / 张 |
| grok-imagine-image-quality | 图像 | — | $0.50 / 张 |
| viduq3-turbo | 视频 | 5 秒 720p | $3.00 / 条 |
| viduq3-turbo-540p | 视频 | 4 秒 540p | $1.60 / 条 |
| pixverse-video | 视频 | 5 秒 540p（v5） | $1.85 / 条 |
| MiniMax-Hailuo-2.3 | 视频 | 6 秒 768P | $3.20 / 条 |
| MiniMax-Hailuo-02 | 视频 | 6 秒 768P | $3.20 / 条 |
| wan2.6-i2v | 视频 | 5 秒 720P，图生视频 | $3.00 / 条 |

Veo 和 Grok Video 当前不在目录里——上面这些就是媒体阵容的全部。

## 配置：一把 Key 通所有

在 Router One 控制台创建 API Key 并充值——支付宝和银行卡在同一个托管收银台，另有 USDT/USDC（6 条链），无需境外信用卡。你可能已经在调聊天模型的那把 Key，直接就能打媒体端点。

```bash
export ROUTER_ONE_KEY=sk-your-router-one-key
```

## 生图

图像端点遵循 OpenAI Images API 请求格式——POST 一个模型 ID 和 prompt：

```bash
curl -X POST https://api.router.one/v1/images/generations \
  -H "Authorization: Bearer $ROUTER_ONE_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model": "gpt-image-2",
       "prompt": "陶瓷茶壶的平铺产品图，柔和的晨光"}'
```

因为格式是 OpenAI 兼容的，现有 OpenAI SDK 生图代码改个 base URL 和 Key 就能跑。选型经验：

- **gpt-image-2**——提示词还原度和图内文字渲染最强；产品图、UI mockup 的默认选择。
- **Gemini 3 Pro Image（"Nano Banana"）**——多模态提示词、写实感强；参考图改风格很好用。
- **Gemini 3.1 Flash Image**——同一条 Gemini 线上的 Flash 档，2026 年 8 月进的目录；提示词写法一样，单价一样，定型前值得拿自己的 prompt 和 Pro 档对比一轮——完整请求见 [Nano Banana 2 API 指南](https://router.one/zh/blog/nano-banana-2-api-guide)。
- **[豆包 Seedream 5.0](https://router.one/zh/models/doubao-seedream-5-0-260128)**——prompt 是中文、或产出要中文排版时的首选。
- **Grok Imagine**——目录里是两个条目：grok-imagine-image 和更高画质的 grok-imagine-image-quality。两者单价相同，选哪个看出图效果，不看预算。

完整请求与响应字段见 [Images API 文档](https://router.one/zh/docs/images/createImageGeneration)。

## 生成视频

视频生成是**异步**的：提交任务、拿到任务 ID、轮询到成片就绪。不要给提交调用包一个很紧的客户端超时——用轮询。

```bash
# 1. 提交任务
curl -X POST https://api.router.one/v1/videos/generations \
  -H "Authorization: Bearer $ROUTER_ONE_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model": "viduq3-turbo",
       "prompt": "无人机航拍晨雾中的梯田，山谷里薄雾流动"}'

# 2. 轮询任务直到完成
curl https://api.router.one/v1/videos/generations/{task_id} \
  -H "Authorization: Bearer $ROUTER_ONE_KEY"
```

`wan2.6-i2v` 是图生视频模型：给它一张图，它把图动起来，所以必须带 `image_url`，只给 prompt 不给图会直接返回 400。

```bash
curl -X POST https://api.router.one/v1/videos/generations \
  -H "Authorization: Bearer $ROUTER_ONE_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model": "wan2.6-i2v",
       "prompt": "镜头缓缓推近，杯口冒出热气",
       "image_url": "https://example.com/still.jpg"}'
```

生成时长随模型和负载变化——留好任务 ID 查状态，不要挂着连接干等。视频的时长和分辨率按模型锁死（见上表），请求里写 `duration` 或 `size` 也不会改变成片；另外五个模型是文生视频，带 `image_url` 会被直接拒掉。端点细节见 [Videos API 文档](https://router.one/zh/docs/videos/submitVideoGeneration)。

## 管住媒体开销

媒体生成是 API 账单最容易失控的地方——一个跑嗨了的批量任务，转眼就是几百张图。网关的标准管控对媒体模型同样生效：

- **每请求 trace。**每次生成都进 Dashboard → Logs：模型、单价、状态。财务能看清一次营销活动的素材流水线到底花了多少。
- **Per-key 预算。**给生图流水线单独发一把带上限的 Key，和聊天流量分开。失控任务在上限处停下，不会掏空钱包。
- **按件计价。**每张图是固定价，成本预测就是乘法，不用估 token。

## 常见问题

**有 Sora 吗？**
目前没有。现在的视频阵容是 Vidu Q3 Turbo、PixVerse、MiniMax Hailuo 2.3 和 02，加上做图生视频的通义万相 2.6；Veo 和 Grok Video 当前也不在目录里。目录随模型上线更新，[router.one/models](https://router.one/zh/models) 是唯一事实来源。

**Midjourney 呢？**
不在目录里。生图阵容是 gpt-image-2、Gemini 3 Pro Image、Gemini 3.1 Flash Image、豆包 Seedream 和 Grok Imagine。

**计费是按 token 吗？**
不是——媒体模型按张/按条计固定单价。同一把 Key 上的聊天模型仍按 token 计量。两者出现在同一套成本 trace 和用量面板里。

**一把 Key 能同时跑聊天、生图、视频吗？**
能。这正是网关的意义：一把 OpenAI 兼容 Key 覆盖聊天目录、/v1/images/generations 和 /v1/videos/generations，per-key 预算对全部生效。

**怎么用人民币付？**
支付宝或银行卡在同一个托管收银台给钱包充值，金额按结账页汇率折算。稳定币（USDT/USDC，6 条链）也可以。完整流程见[支付教程](https://router.one/zh/blog/wechat-pay-alipay-openai-claude-api)。

## 结论

在国内做图像和视频生成，不再需要翻墙、境外卡，或者同时维护三家供应商账号。一把网关 Key：生图有 gpt-image-2、Nano Banana、Seedream、Grok Imagine，生视频有 Vidu Q3 Turbo、PixVerse、MiniMax Hailuo、通义万相 2.6——固定单价，每次生成都有账。

端点全貌看[生图 API 页](https://router.one/zh/image-generation-api)，视频细节看[视频生成 API 页](https://router.one/zh/veo-api-china)，实时价格看 [router.one/models](https://router.one/zh/models)。

## 相关页面

- 本页规范地址：https://router.one/zh/blog/image-generation-api-china-guide
- LLM API 支付：https://router.one/zh/wechat-pay-llm-api
- 全部博客文章：https://router.one/zh/blog
- 模型与每模型 token 价格：https://router.one/zh/models （markdown：https://router.one/zh/models.md ）
- 定价：https://router.one/zh/pricing
- API 文档（markdown）：https://router.one/zh/docs.md
- 公司事实（markdown）：https://router.one/zh/facts/company.md
