模型广场
模型广场 用于查看 AI Gateway 已接入的模型、供应商、端点、协议类型、价格和调用示例。用户可以在这里完成模型查找、价格对比、接入点确认和调用代码复制,是从“选择模型”到“完成 API 调用”的主要入口。
模型广场适合用于以下场景:
- 查找平台支持的文本、视觉、向量、图片、视频、3D 等模型。
- 按模型生产商或端点名称筛选模型。
- 对比模型刊例价和客户折后价。
- 查看某个模型可用的接入点、协议类型和状态。
- 复制 curl、Python 等调用示例。
- 为 API Key 路由策略选择合适的模型端点。

页面入口
进入 AI Gateway 控制台后,点击左侧导航栏的 模型广场,或直接访问:
列表页结构
模型广场列表页主要由
筛选区 和 模型卡片区 组成。
| 区域 | 说明 |
|---|---|
| 展示当前筛选条件下可见的模型数量,例如 、。 |
| 按模型名称关键字搜索,例如 、、。 |
| 切换模型展示方式。原型中展示为网格视图,线上页面可能支持网格或列表。 |
| 按模型厂商筛选,例如 Qwen、Doubao、DeepSeek、GLM 等。 |
| 按接入端点筛选,例如Doubao-Direct、Aliyun-Direct等。 |
| 展示模型名称、内置标识、描述、刊例价和折后价。 |
查找模型
用户可以通过三种方式快速定位模型:
- 使用
输入关键字。搜索模型名称 - 使用
下拉框按厂商过滤。模型生产商 - 使用
下拉框按可用端点过滤。端点名称
按模型名称搜索
在搜索框输入模型名称关键字后,列表会只显示匹配模型。
常见搜索方式:
| 搜索词 | 可能用途 |
|---|---|
| 查找通义千问相关模型。 |
| 查找 DeepSeek 对话或推理模型。 |
| 查找豆包文本、视觉、图片、视频或 3D 模型。 |
| 查找向量模型。 |
| 查找视频生成模型。 |
如果没有找到结果,可以尝试:
- 删除部分关键字,使用更短的模型系列名搜索。
- 将
和模型生产商
切回端点名称
。全部 - 到价格文档或 API 调用文档中确认模型标识是否与页面名称一致。
按模型生产商筛选
点击
模型生产商 下拉框,可以按厂商筛选模型。
常见生产商包括:
| 生产商 | 说明 |
|---|---|
| 阿里云百炼 / 通义千问系列文本、视觉、Embedding 等模型。 |
| 火山引擎豆包系列文本、视觉、图片、视频、3D、Embedding 等模型。 |
| DeepSeek 对话、推理和代码相关模型。 |
| 智谱 GLM 系列模型。 |
| 月之暗面 Kimi 系列模型。 |
| MiniMax 系列模型。 |
生产商筛选适合在已经确定厂商或模型家族时使用。例如,只想查看豆包模型价格和接入点时,可以选择
Doubao。
按端点名称筛选
点击
端点名称 下拉框,可以按平台接入点过滤模型。
端点名称通常代表模型接入来源或供应商路由入口,例如:
| 端点名称示例 | 说明 |
|---|---|
| Qwen / 百炼相关端点。 |
| 火山引擎豆包相关端点。 |
| 腾讯默认端点。 |
| GLM 默认端点。 |
端点筛选适合以下场景:
- 只想查看某个供应商或区域下可用的模型。
- 配置 API Key 路由策略前,确认某个端点支持哪些模型。
- 排查某个端点不可用时,确认是否存在其他端点可替代。
模型卡片说明
模型卡片用于快速了解模型用途和价格。
| 字段 | 说明 |
|---|---|
| 面向用户展示的模型名称,例如 、。 |
| 表示该模型由平台内置供应商提供,用户可以直接通过 AI Gateway 调用。 |
| 简要说明模型能力和适用场景,例如代码、推理、中文生成、向量检索等。 |
| 云厂商或平台标准价格,用于对比。 |
| 当前客户可用的折扣后价格。实际页面中通常会重点展示折后价。 |
| 表示该模型可能存在多个端点或多个计费项,当前展示的是起步价格或最低价格。 |
刊例价与折后价
模型卡片中通常同时展示
刊例价 和 折后价:
:用于展示标准价格或供应商公开价格。刊例价
:用于展示当前客户可用价格,通常是实际关注的价格。折后价
:表示该模型可能有多个接入点,不同接入点折扣不同;也可能存在 Input、Output、Cache Hit 等多个计费项。起
例如文本模型通常展示:
向量模型可能只有输入价格:
不同模型类型的计费单位可能不同:
| 模型类型 | 常见计费方式 |
|---|---|
| 文本模型 | Input Token、Output Token、Cache Creation、Cache Hit。 |
| 视觉理解模型 | 文本 Token、图片 Token 或多模态输入 Token。 |
| 向量模型 | 输入 Token 或多模态 Embedding 请求量。 |
| 图片生成模型 | 图片张数、规格、图片 Token 或任务规格。 |
| 视频生成模型 | 秒数、分辨率、任务规格或生成任务量。 |
| 3D 模型 | 任务量、输出规格或生成结果规格。 |
进入模型详情
点击模型卡片后,可以进入模型详情页。详情页用于查看该模型的完整接入信息,包括基础信息、接入点管理、价格明细和调用示例。

详情页通常包含以下模块:
| 模块 | 说明 |
|---|---|
| 展示模型名称、模型标识、模型生产商和描述。 |
| 展示该模型可用的接入点、协议类型、计费价格和状态。 |
| 提供 curl、Python 或不同协议格式的调用示例。 |
基础信息
基础信息用于确认当前查看的是哪个模型。
| 字段 | 说明 |
|---|---|
| 页面展示名称,便于用户识别。 |
| API 调用时使用的模型 ID,需要在请求体 字段中填写。 |
| 模型所属厂商或模型家族。 |
| 模型能力、适用场景和特点说明。 |
调用 API 时,应优先复制详情页中的
模型标识,避免使用展示名称导致调用失败。
示例:
接入点管理
接入点管理 展示当前模型可用的全部接入点。一个模型可能对应多个接入点,不同接入点可能有不同供应商、协议、折扣价格和状态。
接入点表格字段说明:
| 字段 | 说明 |
|---|---|
| API 请求中使用的模型 ID。 |
| 模型接入点名称。 |
| 当前端点使用的调用协议,例如 OpenAI、Anthropic、OpenAI Response 等。 |
| 展示刊例价和客户折后价,鼠标悬停或点击可查看更细计费项。 |
| 当前端点是否启用。只有启用状态的端点才可正常参与调用或路由。 |
| 进入监控或其他运维入口,用于查看端点运行情况。 |
价格明细
在
计费价格 上悬停或点击,可以查看更细的价格明细。原型中展示了以下计费项:
| 计费项 | 说明 |
|---|---|
| 输入 Token 价格。 |
| 输出 Token 价格。 |
| 缓存命中 Token 价格。 |
线上不同模型可能还会展示:
| 计费项 | 说明 |
|---|---|
| 缓存创建价格。 |
| 缓存读取价格。 |
| 隐式缓存命中价格。 |
| 图片输入或输出相关 Token 价格。 |
| 视频生成按秒计费。 |
| 图片、视频或 3D 生成任务按任务计费。 |
价格字段建议这样理解:
- 卡片页展示的是快速对比价格,适合初步选型。
- 详情页接入点价格更准确,适合接入前确认。
- 多个接入点价格不同时,应结合 API Key 路由策略判断实际会走哪个端点。
- 使用 BYOK 时,AI Gateway 页面展示的系统内置价格不一定等同于云厂商侧最终账单。
协议类型
不同模型和供应商可能使用不同协议。详情页的
协议类型 用于告诉用户应该使用哪类 API 格式。
| 协议类型 | 常见路径 | 说明 |
|---|---|---|
| | 适用于多数文本对话模型,如 Qwen、DeepSeek、GLM、Kimi、OpenAI 等。 |
| | 适用于 Claude 系列或 Anthropic 兼容模型。 |
| | 适用于支持 Responses API 的模型。 |
| | 适用于火山引擎部分文本或视觉模型。 |
| | 适用于 Seedream 等图片生成模型。 |
| 或 | 适用于 Seedance、HappyHorse 等视频生成模型。 |
| 或供应商多模态 Embedding 路径 | 适用于文本或多模态向量模型。 |
模型调用示例
详情页底部提供模型调用示例,用户可以直接复制后替换 API Key 使用。

常见示例类型包括:
| 示例类型 | 说明 |
|---|---|
| OpenAI 兼容协议的 curl 示例。 |
| 使用 Python requests 调用 OpenAI 兼容接口。 |
| Responses API 的 curl 示例。 |
| Anthropic Messages 协议示例。 |
| 向量模型调用示例。 |
| 图片、视频或任务类模型调用示例。 |
OpenAI 兼容调用示例
Python requests 示例
调用前检查
复制示例后,建议检查以下内容:
是否替换为在 API KEY 管理 中创建的有效 Key。API_KEY
是否与详情页中的model
完全一致。模型标识- 请求路径是否与协议类型匹配。
- API Key 的路由策略是否允许访问该模型或端点。
- API Key 是否设置了过低的 Token 限额或金额限额。
选择模型建议
选择模型时,建议从以下维度评估:
| 维度 | 说明 |
|---|---|
| 文本、代码、视觉、Embedding、图片、视频、3D 等任务需要选择对应模型类型。 |
| 对成本敏感时,优先比较折后输入价、输出价和缓存价格。 |
| 长文档、知识库问答、代码仓库分析等场景需要关注上下文窗口。 |
| 交互式应用更关注低延迟;批量任务更关注吞吐。 |
| 合规、区域、稳定性或企业采购要求可能影响供应商选择。 |
| 不同协议的请求结构不同,接入前应确认代码是否兼容。 |
| 同一模型可能有多个端点,实际调用端点受 API Key 路由策略影响。 |
与其他模块的关系
| 模块 | 关系 |
|---|---|
| 使用模型前需要先创建 API Key,并可配置该 Key 的路由策略和限额。 |
| 如果希望使用企业自有云厂商 Key,需要先在 BYOK 中配置供应商密钥。 |
| 模型调用后,可在用量统计中查看请求数、Token、系统成本和 BYOK 成本。 |
| 模型广场展示模型价格入口,模型价格文档提供更完整的价格表和计费说明。 |
| 模型广场提供单模型示例,API 调用说明提供按厂商、模型类型拆分的详细参数说明。 |
常见问题
搜索不到模型
可以检查:
- 搜索词是否过长或拼写不一致。
- 是否同时选择了模型生产商或端点筛选,导致结果被过滤。
- 模型是否暂未开通或暂未上架。
- 模型名称和模型标识是否混用,例如展示名与 API 调用 ID 可能不同。
卡片价格和详情页价格不完全一致
可能原因包括:
- 卡片展示的是起步价或最低价。
- 详情页按不同接入点展示价格。
- 不同端点折扣不同。
- 模型存在多个计费项,卡片只展示主要计费项。
接入前应以详情页
接入点管理 中的价格明细为准。
调用示例不能直接跑通
可以检查:
- API Key 是否有效。
字段是否复制了详情页中的模型标识。model- 请求路径是否和协议类型一致。
- Header 是否正确,例如 OpenAI 兼容接口使用
。Authorization: Bearer <key> - API Key 路由策略是否限制为某些供应商或仅 BYOK。
- 目标模型是否需要使用专门的图片、视频、Embedding 或任务接口。
为什么同一个模型有多个接入点
同一模型可能由多个供应商、区域或转发端点提供。多个接入点可以提升可用性,也可以让用户在成本、延迟、吞吐和合规之间做选择。
实际调用时,系统会结合 API Key 的路由策略决定使用哪个端点:
- 默认模式:按价格、吞吐或延迟策略自动排序。
- 指定策略:按用户拖拽顺序调用。
- 仅 BYOK:只调用用户选择的 BYOK。
联系我们
