模型广场

模型广场
模型广场
用于查看 AI Gateway 已接入的模型、供应商、端点、协议类型、价格和调用示例。用户可以在这里完成模型查找、价格对比、接入点确认和调用代码复制,是从“选择模型”到“完成 API 调用”的主要入口。

模型广场适合用于以下场景:

  • 查找平台支持的文本、视觉、向量、图片、视频、3D 等模型。
  • 按模型生产商或端点名称筛选模型。
  • 对比模型刊例价和客户折后价。
  • 查看某个模型可用的接入点、协议类型和状态。
  • 复制 curl、Python 等调用示例。
  • 为 API Key 路由策略选择合适的模型端点。

页面入口

进入 AI Gateway 控制台后,点击左侧导航栏的 模型广场,或直接访问:

<https://aitoken.clickzetta.com/model>

列表页结构

模型广场列表页主要由

筛选区
筛选区
模型卡片区
模型卡片区
组成。

区域说明
模型总数
模型总数
展示当前筛选条件下可见的模型数量,例如
共 88 模型
共 88 模型
共 90 模型
共 90 模型
搜索模型名称
搜索模型名称
按模型名称关键字搜索,例如
DeepSeek
DeepSeek
Qwen
Qwen
Doubao
Doubao
视图切换
视图切换
切换模型展示方式。原型中展示为网格视图,线上页面可能支持网格或列表。
模型生产商
模型生产商
按模型厂商筛选,例如 Qwen、Doubao、DeepSeek、GLM 等。
端点名称
端点名称
按接入端点筛选,例如Doubao-Direct、Aliyun-Direct等。
模型卡片
模型卡片
展示模型名称、内置标识、描述、刊例价和折后价。

查找模型

用户可以通过三种方式快速定位模型:

  1. 使用
    搜索模型名称
    搜索模型名称
    输入关键字。
  2. 使用
    模型生产商
    模型生产商
    下拉框按厂商过滤。
  3. 使用
    端点名称
    端点名称
    下拉框按可用端点过滤。

按模型名称搜索

在搜索框输入模型名称关键字后,列表会只显示匹配模型。

常见搜索方式:

搜索词可能用途
qwen
qwen
查找通义千问相关模型。
deepseek
deepseek
查找 DeepSeek 对话或推理模型。
doubao
doubao
查找豆包文本、视觉、图片、视频或 3D 模型。
embedding
embedding
查找向量模型。
video
video
查找视频生成模型。

如果没有找到结果,可以尝试:

  • 删除部分关键字,使用更短的模型系列名搜索。
  • 模型生产商
    模型生产商
    端点名称
    端点名称
    切回
    全部
    全部
  • 到价格文档或 API 调用文档中确认模型标识是否与页面名称一致。

按模型生产商筛选

点击

模型生产商
模型生产商
下拉框,可以按厂商筛选模型。

常见生产商包括:

生产商说明
Qwen
Qwen
阿里云百炼 / 通义千问系列文本、视觉、Embedding 等模型。
Doubao
Doubao
火山引擎豆包系列文本、视觉、图片、视频、3D、Embedding 等模型。
DeepSeek
DeepSeek
DeepSeek 对话、推理和代码相关模型。
GLM
GLM
智谱 GLM 系列模型。
Kimi
Kimi
月之暗面 Kimi 系列模型。
MiniMax
MiniMax
MiniMax 系列模型。

生产商筛选适合在已经确定厂商或模型家族时使用。例如,只想查看豆包模型价格和接入点时,可以选择

Doubao
Doubao

按端点名称筛选

点击

端点名称
端点名称
下拉框,可以按平台接入点过滤模型。

端点名称通常代表模型接入来源或供应商路由入口,例如:

端点名称示例说明
Aliyun-Direct
Aliyun-Direct
Qwen / 百炼相关端点。
Doubao-Direct
Doubao-Direct
火山引擎豆包相关端点。
Tencent-Direct
Tencent-Direct
腾讯默认端点。
GLM-default
GLM-default
GLM 默认端点。

端点筛选适合以下场景:

  • 只想查看某个供应商或区域下可用的模型。
  • 配置 API Key 路由策略前,确认某个端点支持哪些模型。
  • 排查某个端点不可用时,确认是否存在其他端点可替代。

模型卡片说明

模型卡片用于快速了解模型用途和价格。

字段说明
模型名称
模型名称
面向用户展示的模型名称,例如
DeepSeek Chat
DeepSeek Chat
Doubao Seed 2.1 Pro
Doubao Seed 2.1 Pro
内置
内置
表示该模型由平台内置供应商提供,用户可以直接通过 AI Gateway 调用。
描述
描述
简要说明模型能力和适用场景,例如代码、推理、中文生成、向量检索等。
刊例价
刊例价
云厂商或平台标准价格,用于对比。
折后价
折后价
当前客户可用的折扣后价格。实际页面中通常会重点展示折后价。
表示该模型可能存在多个端点或多个计费项,当前展示的是起步价格或最低价格。

刊例价与折后价

模型卡片中通常同时展示

刊例价
刊例价
折后价
折后价

  • 刊例价
    刊例价
    :用于展示标准价格或供应商公开价格。
  • 折后价
    折后价
    :用于展示当前客户可用价格,通常是实际关注的价格。
  • :表示该模型可能有多个接入点,不同接入点折扣不同;也可能存在 Input、Output、Cache Hit 等多个计费项。

例如文本模型通常展示:

刊例 输入 12.6 YUAN/M Tokens / 输出 100.8 YUAN/M Tokens 起 折后 输入 9.07 YUAN/M Tokens / 输出 72.58 YUAN/M Tokens 起

向量模型可能只有输入价格:

刊例 输入 0.936 YUAN/M Tokens 起 折后 输入 0.67 YUAN/M Tokens 起

不同模型类型的计费单位可能不同:

模型类型常见计费方式
文本模型Input Token、Output Token、Cache Creation、Cache Hit。
视觉理解模型文本 Token、图片 Token 或多模态输入 Token。
向量模型输入 Token 或多模态 Embedding 请求量。
图片生成模型图片张数、规格、图片 Token 或任务规格。
视频生成模型秒数、分辨率、任务规格或生成任务量。
3D 模型任务量、输出规格或生成结果规格。

进入模型详情

点击模型卡片后,可以进入模型详情页。详情页用于查看该模型的完整接入信息,包括基础信息、接入点管理、价格明细和调用示例。

详情页通常包含以下模块:

模块说明
基础信息
基础信息
展示模型名称、模型标识、模型生产商和描述。
接入点管理
接入点管理
展示该模型可用的接入点、协议类型、计费价格和状态。
模型调用示例
模型调用示例
提供 curl、Python 或不同协议格式的调用示例。

基础信息

基础信息用于确认当前查看的是哪个模型。

字段说明
模型名称
模型名称
页面展示名称,便于用户识别。
模型标识
模型标识
API 调用时使用的模型 ID,需要在请求体
model
model
字段中填写。
模型生产商
模型生产商
模型所属厂商或模型家族。
描述
描述
模型能力、适用场景和特点说明。

调用 API 时,应优先复制详情页中的

模型标识
模型标识
,避免使用展示名称导致调用失败。

示例:

{ "model": "openai/gpt-5.2-codex" }

接入点管理

接入点管理
接入点管理
展示当前模型可用的全部接入点。一个模型可能对应多个接入点,不同接入点可能有不同供应商、协议、折扣价格和状态。

接入点表格字段说明:

字段说明
模型标识
模型标识
API 请求中使用的模型 ID。
端点名称
端点名称
模型接入点名称。
协议类型
协议类型
当前端点使用的调用协议,例如 OpenAI、Anthropic、OpenAI Response 等。
计费价格
计费价格
展示刊例价和客户折后价,鼠标悬停或点击可查看更细计费项。
状态
状态
当前端点是否启用。只有启用状态的端点才可正常参与调用或路由。
操作
操作
进入监控或其他运维入口,用于查看端点运行情况。

价格明细

计费价格
计费价格
上悬停或点击,可以查看更细的价格明细。原型中展示了以下计费项:

计费项说明
Input
Input
输入 Token 价格。
Output
Output
输出 Token 价格。
Cache Hit
Cache Hit
缓存命中 Token 价格。

线上不同模型可能还会展示:

计费项说明
Cache Creation
Cache Creation
缓存创建价格。
Cache Read
Cache Read
缓存读取价格。
Implicit Cache
Implicit Cache
隐式缓存命中价格。
Image Token
Image Token
图片输入或输出相关 Token 价格。
Video Seconds
Video Seconds
视频生成按秒计费。
Task
Task
图片、视频或 3D 生成任务按任务计费。

价格字段建议这样理解:

  1. 卡片页展示的是快速对比价格,适合初步选型。
  2. 详情页接入点价格更准确,适合接入前确认。
  3. 多个接入点价格不同时,应结合 API Key 路由策略判断实际会走哪个端点。
  4. 使用 BYOK 时,AI Gateway 页面展示的系统内置价格不一定等同于云厂商侧最终账单。

协议类型

不同模型和供应商可能使用不同协议。详情页的

协议类型
协议类型
用于告诉用户应该使用哪类 API 格式。

协议类型常见路径说明
OpenAI
OpenAI
/gateway/v1/chat/completions
/gateway/v1/chat/completions
适用于多数文本对话模型,如 Qwen、DeepSeek、GLM、Kimi、OpenAI 等。
Anthropic
Anthropic
/gateway/v1/messages
/gateway/v1/messages
适用于 Claude 系列或 Anthropic 兼容模型。
OpenAI Response
OpenAI Response
/gateway/v1/responses
/gateway/v1/responses
适用于支持 Responses API 的模型。
Volcengine v3 Chat
Volcengine v3 Chat
/gateway/api/v3/chat/completions
/gateway/api/v3/chat/completions
适用于火山引擎部分文本或视觉模型。
Image Generation
Image Generation
/gateway/api/v3/images/generations
/gateway/api/v3/images/generations
适用于 Seedream 等图片生成模型。
Video Task
Video Task
/gateway/api/v3/contents/generations/tasks
/gateway/api/v3/contents/generations/tasks
/gateway/api/v1/services/aigc/video-generation/video-synthesis
/gateway/api/v1/services/aigc/video-generation/video-synthesis
适用于 Seedance、HappyHorse 等视频生成模型。
Embedding
Embedding
/gateway/v1/embeddings
/gateway/v1/embeddings
或供应商多模态 Embedding 路径
适用于文本或多模态向量模型。

模型调用示例

详情页底部提供模型调用示例,用户可以直接复制后替换 API Key 使用。

常见示例类型包括:

示例类型说明
open_ai/REST API-cURL
open_ai/REST API-cURL
OpenAI 兼容协议的 curl 示例。
open_ai/Python-requests
open_ai/Python-requests
使用 Python requests 调用 OpenAI 兼容接口。
openai-response/REST API-cURL
openai-response/REST API-cURL
Responses API 的 curl 示例。
anthropic/REST API-cURL
anthropic/REST API-cURL
Anthropic Messages 协议示例。
embedding
embedding
向量模型调用示例。
image/video/task
image/video/task
图片、视频或任务类模型调用示例。

OpenAI 兼容调用示例

curl -X POST https://cn-shanghai-alicloud-aimesh.api.clickzetta.com/gateway/v1/chat/completions \ -H "Authorization: Bearer $API_KEY" \ -H "Content-Type: application/json" \ -d '{ "model": "openai/gpt-5.2-codex", "messages": [ {"role": "user", "content": "hello"} ] }'

Python requests 示例

import requests url = "https://cn-shanghai-alicloud-aimesh.api.clickzetta.com/gateway/v1/chat/completions" headers = { "Authorization": "Bearer <your-api-key>", "Content-Type": "application/json", } payload = { "model": "openai/gpt-5.2-codex", "messages": [ {"role": "user", "content": "hello"} ], } resp = requests.post(url, headers=headers, json=payload, timeout=60) print(resp.status_code) print(resp.text)

调用前检查

复制示例后,建议检查以下内容:

  1. API_KEY
    API_KEY
    是否替换为在 API KEY 管理 中创建的有效 Key。
  2. model
    model
    是否与详情页中的
    模型标识
    模型标识
    完全一致。
  3. 请求路径是否与协议类型匹配。
  4. API Key 的路由策略是否允许访问该模型或端点。
  5. API Key 是否设置了过低的 Token 限额或金额限额。

选择模型建议

选择模型时,建议从以下维度评估:

维度说明
任务类型
任务类型
文本、代码、视觉、Embedding、图片、视频、3D 等任务需要选择对应模型类型。
价格
价格
对成本敏感时,优先比较折后输入价、输出价和缓存价格。
上下文长度
上下文长度
长文档、知识库问答、代码仓库分析等场景需要关注上下文窗口。
响应速度
响应速度
交互式应用更关注低延迟;批量任务更关注吞吐。
供应商
供应商
合规、区域、稳定性或企业采购要求可能影响供应商选择。
协议类型
协议类型
不同协议的请求结构不同,接入前应确认代码是否兼容。
路由策略
路由策略
同一模型可能有多个端点,实际调用端点受 API Key 路由策略影响。

与其他模块的关系

模块关系
API KEY 管理
API KEY 管理
使用模型前需要先创建 API Key,并可配置该 Key 的路由策略和限额。
BYOK
BYOK
如果希望使用企业自有云厂商 Key,需要先在 BYOK 中配置供应商密钥。
用量统计
用量统计
模型调用后,可在用量统计中查看请求数、Token、系统成本和 BYOK 成本。
模型价格
模型价格
模型广场展示模型价格入口,模型价格文档提供更完整的价格表和计费说明。
API 调用说明
API 调用说明
模型广场提供单模型示例,API 调用说明提供按厂商、模型类型拆分的详细参数说明。

常见问题

搜索不到模型

可以检查:

  1. 搜索词是否过长或拼写不一致。
  2. 是否同时选择了模型生产商或端点筛选,导致结果被过滤。
  3. 模型是否暂未开通或暂未上架。
  4. 模型名称和模型标识是否混用,例如展示名与 API 调用 ID 可能不同。

卡片价格和详情页价格不完全一致

可能原因包括:

  • 卡片展示的是起步价或最低价。
  • 详情页按不同接入点展示价格。
  • 不同端点折扣不同。
  • 模型存在多个计费项,卡片只展示主要计费项。

接入前应以详情页

接入点管理
接入点管理
中的价格明细为准。

调用示例不能直接跑通

可以检查:

  1. API Key 是否有效。
  2. model
    model
    字段是否复制了详情页中的模型标识。
  3. 请求路径是否和协议类型一致。
  4. Header 是否正确,例如 OpenAI 兼容接口使用
    Authorization: Bearer <key>
    Authorization: Bearer <key>
  5. API Key 路由策略是否限制为某些供应商或仅 BYOK。
  6. 目标模型是否需要使用专门的图片、视频、Embedding 或任务接口。

为什么同一个模型有多个接入点

同一模型可能由多个供应商、区域或转发端点提供。多个接入点可以提升可用性,也可以让用户在成本、延迟、吞吐和合规之间做选择。

实际调用时,系统会结合 API Key 的路由策略决定使用哪个端点:

  • 默认模式:按价格、吞吐或延迟策略自动排序。
  • 指定策略:按用户拖拽顺序调用。
  • 仅 BYOK:只调用用户选择的 BYOK。
联系我们
预约咨询
微信咨询
电话咨询
邮件咨询