Skip to main content
OpenPAI 采用 预付费 + 按 Token 计费 模式,与 OpenAI 官方一致。 本文说明每一次调用的实际扣费如何计算。

计费要素

每次成功调用都会产生以下用量项:

扣费公式

其中:
  • 输入 / 输出 / 缓存价格 来自各模型的官方定价,以 每百万 Token 美元单价 × OpenPAI 倍率 × 汇率 换算到人民币。
  • 用户分组倍率 由账户所在分组决定,详见 基础概念
  • 缓存价格 通常为输入价格的 0.1× ~ 0.5×,详见 缓存计费

控制台日志示例

调用一次后,日志 页面会展示 Token 与扣费明细(不含 prompt / 响应内容):

不同类型模型的计费

prompt_tokens + completion_tokens 扣费。 若使用提示缓存,缓存命中部分按缓存价格结算。
reasoning_tokens 按输出价格 额外 计费(虽不可见但消耗算力)。 控制台日志会拆分展示思考与回答 Token。
仅按 prompt_tokens(输入)计费,无输出。
生成图数量 + 尺寸 计费,每次调用一笔固定扣费。
TTS 按 输入字符数 计费;Whisper 按 音频时长(秒) 计费。
异步任务模式,按 任务次数 + 操作类型 计费。失败任务不扣费。
(query + 所有 documents)的 Token 总和 计费。

失败请求是否扣费

余额耗尽

账户余额 ≤ 0 时,所有 付费模型 调用立即返回 insufficient_quota(HTTP 403)。 部分免费模型(如内容审核 Moderations)仍可继续使用。

查询消耗

价格调整

  • 新增模型:以接入时官方价格折算上线。
  • 官方调价:OpenPAI 跟随上游调整,提前 24 小时在控制台公告。
  • 降价 / 优惠活动:不定期推送,以控制台 Banner 公告为准。

更多

额度与令牌

账户额度、令牌额度、过期与转移。

缓存计费

OpenAI / Claude / DeepSeek 提示缓存细则。