AI Gateway 计费说明

本文介绍云器 AI Gateway 国内区(人民币计价)模型的计费方式、价格口径、缓存计费规则和国内模型列表价。价格用于帮助用户在接入前估算成本,实际费用请以 模型广场详情页、用量统计页面和最终账单 为准。

价格来源参考产品价格配置表与模型广场展示口径。本文仅采用国内人民币(RMB)列表价;飞书表格中的美元(USD)价格不纳入本章。模型市场价格可能随供应商、模型版本、接入点、区域和产品策略调整。

我该看哪张表

如果只想快速确认某类模型怎么计费,可以按下表选择阅读位置。

使用目标建议查看
调用 Qwen、DeepSeek、GLM、Kimi、MiniMax、豆包文本模型查看
文本模型计费
文本模型计费
和对应模型系列价格表。
想知道缓存为什么更便宜查看
Token 与缓存计费
Token 与缓存计费
使用 HappyHorse 视频模型查看
happyhorse 视频生成系列
happyhorse 视频生成系列
,该系列按秒计费。
使用豆包 Seedance 视频模型查看
豆包视频生成系列
豆包视频生成系列
,该系列按百万 Tokens 计费。
使用豆包 Seedream 图片模型查看
豆包图片生成系列
豆包图片生成系列
使用 3D 生成模型查看
豆包 3D 生成系列
豆包 3D 生成系列
使用 Embedding / 向量模型查看
向量模型价格
向量模型价格
想估算一次调用大概多少钱查看
计费示例
计费示例
想核对实际账单查看
账单核对方法
账单核对方法

价格口径

口径说明
列表价
列表价
/
刊例价
刊例价
本文列出的公开价格口径,用于成本估算和模型选型。
折后价
折后价
模型广场可能展示客户折扣后的价格,实际以页面和账单为准。
实际账单价
实际账单价
最终出账使用的价格,可能受折扣、接入点、BYOK、供应商账单周期等因素影响。
系统成本
系统成本
使用平台内置供应商产生的费用,可在用量统计中查看。
BYOK 成本
BYOK 成本
使用用户自有云厂商 Key 产生的费用,通常由用户在云厂商侧结算。

计费方式

AI Gateway 按需计费。调用模型 API 时,系统按当次实际消耗的 Tokens、时长、张数或任务量累计计费。

特性说明
按需计费
按需计费
无最低消费门槛,按实际调用量计费。
按次计量
按次计量
每次模型调用都会记录请求量、Token、计费量和成本。
按 API Key 归因
按 API Key 归因
可在用量统计中按 API Key 查看具体业务消耗。
按模型归因
按模型归因
可在用量统计中查看各模型的请求数、Token 和费用。
按月出账
按月出账
账单通常按月汇总,最终金额以账单为准。

Token 与缓存计费

文本模型 Token 计费

按 Token 计费的对话模型通常区分

输入
输入
输出
输出

字段含义
输入
输入
用户请求中 prompt、messages、上下文等输入内容的 Token 单价。
输出
输出
模型生成内容的 Token 单价。
上下文窗口
上下文窗口
部分模型按上下文窗口分段计价,长上下文可能对应更高单价。

文本模型费用通常按以下公式估算:

费用 = 输入 Token / 1,000,000 × 输入单价 + 输出 Token / 1,000,000 × 输出单价

示例:输入 1,000 tokens,输出 2,000 tokens;输入价 2 元/M Tokens,输出价 8 元/M Tokens:

1,000 / 1,000,000 × 2 + 2,000 / 1,000,000 × 8 = 0.018 元

缓存能省多少钱

如果业务反复发送相同的长系统提示词、知识库文档或固定上下文,模型可以复用已处理过的前缀内容,这就是缓存。缓存命中的单价通常低于普通输入价,因此适合长 Prompt、多轮对话和 Agent 工作流。

缓存主要分为两类:

类型工作方式价格表字段
显式缓存
显式缓存
用户或接口主动声明要缓存某段内容。首次写入可能收取写入费,后续命中按较低命中价计费。
显式·写入
显式·写入
显式·命中
显式·命中
缓存存储
缓存存储
隐式缓存
隐式缓存
系统自动识别重复前缀并复用,无需用户显式声明。
隐式·命中
隐式·命中

各列含义:

字段说明
显式·写入
显式·写入
首次把一段 Prompt 写入缓存时收取。
显式·命中
显式·命中
后续请求命中显式缓存时收取。
隐式·命中
隐式·命中
系统自动识别重复内容并命中时收取。
缓存存储
缓存存储
部分模型会对缓存内容按存储时长收取费用。

厂商缓存支持情况

厂商 / 模型族显式缓存隐式缓存
通义千问 Qwen
通义千问 Qwen
支持部分支持,3.5 系列支持;3.6 / 3.7 系列暂未提供。
DeepSeek
DeepSeek
部分支持,v3.2 支持。部分支持,v3.2 / v4-flash / v4-pro / r1 支持。
智谱 GLM
智谱 GLM
部分支持,5.1 支持。支持。
月之暗面 Kimi
月之暗面 Kimi
支持。支持。
MiniMax
MiniMax
不支持。支持。
豆包
豆包
支持,另收缓存存储费。支持。

非文本模型计费

视频、图片、3D 和向量模型不一定按普通文本 Token 计费,接入前应先确认模型详情页中的计费单位。

模型类型计费说明
视频生成
视频生成
HappyHorse 系列按生成视频时长计费,单位为元/秒;豆包 Seedance 系列按百万 Tokens 计费,并按是否含视频输入、输出分辨率等维度分档。
图片生成
图片生成
豆包 Seedream 系列按百万 Tokens 计费,文生图、图生图同价。
3D 生成
3D 生成
豆包 Seed3D、Hyper3D、Hitem3D 按百万 Tokens 计费,并按白模、纹理、PBR、精度等规格分档。
多模态 Embedding
多模态 Embedding
Qwen3 VL Embedding、豆包 doubao-embedding-vision 按输入数据类型分别计价,文本输入价格低于图片 / 视频输入。

国内模型列表价

以下价格单位如无特殊说明,均为

元 / 百万 Tokens
元 / 百万 Tokens

通义千问 Qwen 系列

系列模型名称上下文窗口输入输出显式·写入显式·命中隐式·命中
Qwen Max
qwen3.7-max
qwen3.7-max
0–1M1236151.22.4
Qwen Max
qwen3.6-max-preview
qwen3.6-max-preview
0–128K95411.250.9
Qwen Max
qwen3.6-max-preview
qwen3.6-max-preview
128K–256K159018.751.5
Qwen Max
qwen3-max
qwen3-max
0–32K2.5103.1250.250.5
Qwen Max
qwen3-max
qwen3-max
32K–128K41650.40.8
Qwen Max
qwen3-max
qwen3-max
128K–256K7288.750.71.4
Qwen Max
qwen-max
qwen-max
不区分上下文2.49.60.48
Qwen Plus
qwen3.7-plus
qwen3.7-plus
0–256K282.50.20.4
Qwen Plus
qwen3.7-plus
qwen3.7-plus
256K–1M6247.50.61.2
Qwen Plus
qwen3.6-plus
qwen3.6-plus
0–256K2122.50.2
Qwen Plus
qwen3.6-plus
qwen3.6-plus
256K–1M848100.8
Qwen Plus
qwen3.5-plus
qwen3.5-plus
0–128K0.84.810.080.16
Qwen Plus
qwen3.5-plus
qwen3.5-plus
128K–256K2122.50.20.4
Qwen Plus
qwen3.5-plus
qwen3.5-plus
256K–1M42450.40.8
Qwen Plus
qwen-plus
qwen-plus
0–128K0.8810.080.16
Qwen Plus
qwen-plus
qwen-plus
128K–256K2.42430.240.48
Qwen Plus
qwen-plus
qwen-plus
256K–1M4.86460.480.96
Qwen Flash
qwen3.6-flash
qwen3.6-flash
0–256K1.27.21.50.12
Qwen Flash
qwen3.6-flash
qwen3.6-flash
256K–1M4.828.860.48
Qwen Flash
qwen3.5-flash
qwen3.5-flash
0–128K0.220.250.02
Qwen Flash
qwen3.5-flash
qwen3.5-flash
128K–256K0.8810.08
Qwen Flash
qwen3.5-flash
qwen3.5-flash
256K–1M1.2121.50.12

qwen3-vl-embedding
qwen3-vl-embedding
属于向量模型,按文本输入、图片 / 视频输入分别计费,价格见下方
向量模型价格
向量模型价格

MiniMax 系列

模型名称输入输出隐式·命中
MiniMax/MiniMax-M2.7
MiniMax/MiniMax-M2.7
2.18.40.42
MiniMax-M2.5
MiniMax-M2.5
2.18.40.42

DeepSeek 系列

模型名称输入输出显式·写入显式·命中隐式·命中
deepseek-r1
deepseek-r1
4160.8
deepseek-v3.2
deepseek-v3.2
232.50.20.4
deepseek-v4-flash
deepseek-v4-flash
120.2
deepseek-v4-pro
deepseek-v4-pro
12242.4

智谱 GLM 系列

模型名称上下文窗口输入输出显式·写入显式·命中隐式·命中
glm-4.7
glm-4.7
0–32K3140.6
glm-4.7
glm-4.7
32K–166K4160.8
glm-5
glm-5
0–32K4180.8
glm-5
glm-5
32K–198K6221.2
glm-5.1
glm-5.1
0–32K6247.50.61.2
glm-5.1
glm-5.1
32K–200K828100.81.6
glm-5.2
glm-5.2
8281.6

月之暗面 Kimi 系列

模型名称输入输出显式·写入显式·命中隐式·命中
kimi-k2.5
kimi-k2.5
42150.40.8
kimi-k2.6
kimi-k2.6
6.5278.1250.651.3

豆包文本系列

豆包文本系列按上下文窗口区间分段计价;缓存存储按

0.017 元 / 百万 Tokens · 小时
0.017 元 / 百万 Tokens · 小时
另行计费。

Doubao Seed 2.0 系列

模型名称上下文窗口输入输出缓存存储显式·命中隐式·命中
doubao-seed-evolving
doubao-seed-evolving
输入长度 [0, 256K]6300.0171.21.2
doubao-seed-2.1-pro
doubao-seed-2.1-pro
输入长度 [0, 256K]6300.0171.21.2
doubao-seed-2.1-turbo
doubao-seed-2.1-turbo
输入长度 [0, 256K]3150.0170.60.6
doubao-seed-2.0-pro
doubao-seed-2.0-pro
[0, 32K]3.2160.0170.640.64
doubao-seed-2.0-pro
doubao-seed-2.0-pro
(32K, 128K]4.8240.0170.960.96
doubao-seed-2.0-pro
doubao-seed-2.0-pro
(128K, 256K]9.6480.0171.921.92
doubao-seed-2.0-lite
doubao-seed-2.0-lite
[0, 32K]0.63.60.0170.120.12
doubao-seed-2.0-lite
doubao-seed-2.0-lite
(32K, 128K]0.95.40.0170.180.18
doubao-seed-2.0-lite
doubao-seed-2.0-lite
(128K, 256K]1.810.80.0170.360.36
doubao-seed-2.0-lite(音频输入)
doubao-seed-2.0-lite(音频输入)
[0, 32K]93.60.0171.81.8
doubao-seed-2.0-lite(音频输入)
doubao-seed-2.0-lite(音频输入)
(32K, 128K]13.55.40.0172.72.7
doubao-seed-2.0-lite(音频输入)
doubao-seed-2.0-lite(音频输入)
(128K, 256K]2710.80.0175.45.4
doubao-seed-2.0-mini
doubao-seed-2.0-mini
[0, 32K]0.220.0170.040.04
doubao-seed-2.0-mini
doubao-seed-2.0-mini
(32K, 128K]0.440.0170.080.08
doubao-seed-2.0-mini
doubao-seed-2.0-mini
(128K, 256K]0.880.0170.160.16
doubao-seed-2.0-mini(音频输入)
doubao-seed-2.0-mini(音频输入)
[0, 32K]320.0170.60.6
doubao-seed-2.0-mini(音频输入)
doubao-seed-2.0-mini(音频输入)
(32K, 128K]640.0171.21.2
doubao-seed-2.0-mini(音频输入)
doubao-seed-2.0-mini(音频输入)
(128K, 256K]1280.0172.42.4
doubao-seed-2.0-code
doubao-seed-2.0-code
[0, 32K]3.2160.0170.640.64
doubao-seed-2.0-code
doubao-seed-2.0-code
(32K, 128K]4.8240.0170.960.96
doubao-seed-2.0-code
doubao-seed-2.0-code
(128K, 256K]9.6480.0171.921.92

Doubao Seed 1.8 / 1.6 系列

模型名称上下文窗口输入输出缓存存储显式·命中隐式·命中
doubao-seed-1.8
doubao-seed-1.8
[0, 32K]0.880.0170.160.16
doubao-seed-1.8
doubao-seed-1.8
(32K, 128K]1.2160.0170.160.16
doubao-seed-1.8
doubao-seed-1.8
(128K, 256K]2.4240.0170.160.16
doubao-seed-character
doubao-seed-character
[0, 32K]0.820.0170.160.16
doubao-seed-character
doubao-seed-character
(32K, 128K]1.260.0170.160.16
doubao-seed-code
doubao-seed-code
[0, 32K]1.280.0170.240.24
doubao-seed-code
doubao-seed-code
(32K, 128K]1.4120.0170.240.24
doubao-seed-code
doubao-seed-code
(128K, 256K]2.8160.0170.240.24
doubao-seed-1.6
doubao-seed-1.6
[0, 32K]0.880.0170.160.16
doubao-seed-1.6
doubao-seed-1.6
(32K, 128K]1.2160.0170.160.16
doubao-seed-1.6
doubao-seed-1.6
(128K, 256K]2.4240.0170.160.16
doubao-seed-1.6-lite
doubao-seed-1.6-lite
[0, 32K]0.32.40.0170.060.06
doubao-seed-1.6-lite
doubao-seed-1.6-lite
(32K, 128K]0.640.0170.060.06
doubao-seed-1.6-lite
doubao-seed-1.6-lite
(128K, 256K]1.2120.0170.060.06
doubao-seed-1.6-flash
doubao-seed-1.6-flash
[0, 32K]0.151.50.0170.030.03
doubao-seed-1.6-flash
doubao-seed-1.6-flash
(32K, 128K]0.330.0170.030.03
doubao-seed-1.6-flash
doubao-seed-1.6-flash
(128K, 256K]0.660.0170.030.03
doubao-seed-1.6-vision
doubao-seed-1.6-vision
[0, 32K]0.880.0170.160.16
doubao-seed-1.6-vision
doubao-seed-1.6-vision
(32K, 128K]1.2160.0170.160.16
doubao-seed-1.6-vision
doubao-seed-1.6-vision
(128K, 256K]2.4240.0170.160.16

Doubao 其他文本模型

模型名称上下文窗口输入输出缓存存储显式·命中隐式·命中
doubao-seed-translation
doubao-seed-translation
1.23.6
doubao-1.5-pro-32k
doubao-1.5-pro-32k
0.820.0170.160.16
doubao-1.5-lite-32k
doubao-1.5-lite-32k
0.30.60.0170.060.06
doubao-1.5-vision-pro
doubao-1.5-vision-pro
39

happyhorse 视频生成系列

表中价格单位为

元 / 秒
元 / 秒

模型类型模型名称计费维度720P1080P
文生视频
happyhorse-1.0-t2v
happyhorse-1.0-t2v
元 / 秒0.91.6
图生视频(首帧)
happyhorse-1.0-i2v
happyhorse-1.0-i2v
元 / 秒0.91.6
参考生视频
happyhorse-1.0-r2v
happyhorse-1.0-r2v
元 / 秒0.91.6

豆包视频生成系列

表中价格单位为

元 / 百万 Tokens
元 / 百万 Tokens

模型名称价格维度价格
doubao-seedance-2.0
doubao-seedance-2.0
输出 480p / 720p · 输入不含视频46
doubao-seedance-2.0
doubao-seedance-2.0
输出 480p / 720p · 输入含视频28
doubao-seedance-2.0
doubao-seedance-2.0
输出 1080p · 输入不含视频51
doubao-seedance-2.0
doubao-seedance-2.0
输出 1080p · 输入含视频31
doubao-seedance-2.0
doubao-seedance-2.0
输出 4K · 输入不含视频26
doubao-seedance-2.0
doubao-seedance-2.0
输出 4K · 输入含视频16
doubao-seedance-2.0-fast
doubao-seedance-2.0-fast
输出 480p / 720p · 输入不含视频37
doubao-seedance-2.0-fast
doubao-seedance-2.0-fast
输出 480p / 720p · 输入含视频22
doubao-seedance-2.0-mini
doubao-seedance-2.0-mini
输出 480p / 720p · 输入不含视频23
doubao-seedance-2.0-mini
doubao-seedance-2.0-mini
输出 480p / 720p · 输入含视频14
doubao-seedance-1.5-pro
doubao-seedance-1.5-pro
有声视频16
doubao-seedance-1.5-pro
doubao-seedance-1.5-pro
无声视频8
doubao-seedance-1.0-pro
doubao-seedance-1.0-pro
15
doubao-seedance-1.0-pro-fast
doubao-seedance-1.0-pro-fast
4.2

豆包图片生成系列

表中价格单位为

元 / 百万 Tokens
元 / 百万 Tokens

模型名称价格维度价格
doubao-seedream-5.0-pro
doubao-seedream-5.0-pro
输入图 · 第 2 张起0.02
doubao-seedream-5.0-pro
doubao-seedream-5.0-pro
输出图 · ≤236 万像素0.3
doubao-seedream-5.0-pro
doubao-seedream-5.0-pro
输出图 · >236 万像素0.6
doubao-seedream-5.0-lite
doubao-seedream-5.0-lite
0.22
doubao-seedream-4.5
doubao-seedream-4.5
0.25
doubao-seedream-4.0
doubao-seedream-4.0
0.2

豆包 3D 生成系列

表中价格单位为

元 / 百万 Tokens
元 / 百万 Tokens

模型名称价格维度价格
doubao-seed3d-2.0
doubao-seed3d-2.0
带纹理和 PBR 材质的 3D 模型2.4
Hyper3d-Gen2
Hyper3d-Gen2
白模 / 带纹理 / PBR / 带纹理 + PBR1.8
Hitem3d-2.0
Hitem3d-2.0
标准白模5.8
Hitem3d-2.0
Hitem3d-2.0
标准纹理模型10.15
Hitem3d-2.0
Hitem3d-2.0
高精白模8.7
Hitem3d-2.0
Hitem3d-2.0
高精纹理模型13.05

向量模型价格

表中价格单位为

元 / 百万 Tokens
元 / 百万 Tokens

模型名称价格维度价格
qwen3-vl-embedding
qwen3-vl-embedding
文本输入0.7
qwen3-vl-embedding
qwen3-vl-embedding
图片 / 视频输入1.8
doubao-embedding-vision
doubao-embedding-vision
文本输入0.7
doubao-embedding-vision
doubao-embedding-vision
图片输入1.8

计费示例

文本模型

调用

qwen3-max
qwen3-max
(0–32K 窗口),输入 10,000 tokens,输出 2,000 tokens,无缓存命中:

10,000 / 1,000,000 × 2.5 + 2,000 / 1,000,000 × 10 = 0.045 元

带显式缓存的文本模型

调用

qwen3.5-plus
qwen3.5-plus
(0–128K 窗口),首次请求写入缓存 5,000 tokens、输出 1,000 tokens;第二次请求命中缓存 5,000 tokens、新输入 500 tokens、输出 1,000 tokens:

首次:5,000 / 1,000,000 × 1 + 1,000 / 1,000,000 × 4.8 = 0.0098 元 二次:5,000 / 1,000,000 × 0.08 + 500 / 1,000,000 × 0.8 + 1,000 / 1,000,000 × 4.8 = 0.0056 元

happyhorse 按秒视频

使用

happyhorse-1.0-t2v
happyhorse-1.0-t2v
生成 720P、5 秒视频:

5 × 0.9 = 4.5 元

seedance 按 Token 视频

使用

doubao-seedance-2.0
doubao-seedance-2.0
输出 1080P、不含视频输入,本次调用消耗 0.5M tokens:

0.5 × 51 = 25.5 元

图片生成

调用

doubao-seedream-5.0-lite
doubao-seedream-5.0-lite
,本次调用消耗 0.1M tokens:

0.1 × 0.22 = 0.022 元

向量模型

使用

doubao-embedding-vision
doubao-embedding-vision
处理 100 万文本 tokens:

1 × 0.7 = 0.7 元

账单核对方法

如果需要核对费用,建议按以下步骤排查:

  1. 模型广场 中进入模型详情,确认模型标识、接入点和价格明细。
  2. API KEY 管理 中确认该 Key 的路由策略,判断实际可能走哪个供应商或 BYOK。
  3. 用量统计 中按模型或 API Key 查看请求数、Token、系统成本和 BYOK 成本。
  4. 对比输入、输出、缓存、图片、视频或任务用量是否符合预期。
  5. 如果使用 BYOK,还需要到对应云厂商侧核对账单。

常见问题

为什么模型广场卡片价格和详情页价格不完全一致

模型卡片通常展示起步价或最低价;详情页会按接入点展示更完整的价格。接入前应以模型详情页

接入点管理
接入点管理
中的价格明细为准。

为什么同一模型有多个价格

同一模型可能按上下文窗口、输入类型、输出分辨率、端点、渠道或缓存命中方式分档计价。实际费用取决于当次请求命中的具体计费维度。

BYOK 是否按本文价格计费

BYOK 调用使用用户自有云厂商 Key,费用通常由用户在云厂商侧直接结算。AI Gateway 页面中的价格和成本展示可用于参考,但最终仍应以云厂商账单为准。

如何降低模型调用成本

  • 优先选择符合任务复杂度的模型,不要所有场景都使用最高规格模型。
  • 对重复长 Prompt、知识库上下文和 Agent 工作流使用缓存能力。
  • 使用 API Key 限额和金额限额控制异常调用风险。
  • 在用量统计中定期查看高消耗模型和高消耗 API Key。
  • 对视频、图片、3D 等非文本模型,先确认计费单位和任务规格。
联系我们
预约咨询
微信咨询
电话咨询
邮件咨询