Skip to content

定价说明

什么是模型

AI 大模型,就是经过海量数据训练后固化下来的「神经网络结构+权重参数+推理逻辑」的整体,可以理解成 AI 的大脑本体。不同模型,能力、精度、成本、擅长任务完全不同。

为什么接口调用总以 model 参数为基准

  1. 定位唯一算力实例:服务商后台跑着很多不同模型/版本,model 是告诉服务器「用哪个大脑处理请求」。
  2. 统一路由与计费:模型直接绑定算力、计费标准、功能权限,接口靠它做调度、计价、限流。
  3. 行业通用规范:不管是 OpenAI、阿里、字节还是开源中转,都用 model 做最核心的标识,保证调用格式统一、可兼容。

一句话:model 是接口找到对应 AI 大脑的唯一钥匙

关于模型的定价

模型的官网定价规则是极为复杂的,但本中转平台屏蔽复杂细节,设计出标准定价模式

模型定价与官网正价对齐,不同模型的定价不同

三种定价方式

定价方式适用场景计费基础
按tokens计费聊天、文本补全等大多数模型Token 数量
按次计费Midjourney、Suno、Sora 等任务型模型每次请求固定价格
按秒计费视频生成任务(如 Remix)秒数 × 模型价格

1. 按tokens计费

计费公式:

最终额度 = (输入 tokens × 模型倍率 + 输出 tokens × 模型倍率 × 补全倍率) × 分组倍率 × 单位额度

涉及的倍率:

倍率类型配置键默认值说明
模型倍率ModelRatio模型特定基础计费倍率,每个模型不同
补全倍率CompletionRatio模型特定输出 tokens 的额外倍率
缓存倍率CacheRatio模型特定缓存读取的折扣倍率
缓存创建倍率CacheCreationRatio1.25缓存创建的额外倍率
分组倍率GroupRatio1.0用户分组的倍率
图片倍率ImageRatio1.0图片生成的倍率
音频倍率AudioRatio1.0音频输入的倍率
音频补全倍率AudioCompletionRatio1.0音频输出的倍率

2. 按次计费

计费公式:

最终额度 = 模型价格 × 分组倍率 × 单位额度

3. 按秒计费

计费公式:

最终额度 = 模型价格 × 秒数 × 分组倍率 × 单位额度