Skip to content

计费与用量核对

用量明细记录了哪些字段,以及怎么把一次调用和一笔费用对上。

This content is not available in your language yet.

按实际用量计费,无订阅门槛。余额不设有效期,未消耗部分持续可用。密钥可单独配置额度上限,用来隔离成员之间的用量。

计费方式随模型而定,可能是按 Token、按次、按图片或按视频。具体口径以模型所属服务分组和当前计费配置为准。

控制台按请求逐条记录:

字段 内容
模型与分组 本次请求使用的模型、协议与服务分组
Token 明细 输入、输出及缓存相关 Token
计费方式与费用 区分 Token、按次、图片或视频等计费模式
请求类型与延迟 调用时间、接口类型与处理延迟
错误分类与状态 按密钥、模型、状态码和错误类别筛选

错误请求在独立的错误记录里查询,不与正常请求混在一起。

  1. 记下发起请求的时间和使用的模型。
  2. 到控制台的用量明细里按时间和模型筛选,找到对应记录。
  3. 对比响应体里的 usage 与记录中的 Token 明细。
  4. 费用等于 Token 数乘以该模型在该分组下的单价,或按次数计价。

流式请求要拿到响应体里的 usage,需在 OpenAI 协议下传 stream_options.include_usage。控制台的记录不依赖这个参数,始终完整。

用量核对流程:记录时间模型密钥,筛选日志,比对输入输出和缓存 Token,按分组计费口径核对费用
用量核对流程示意图,不包含真实账户或账单。不同计费方式需分别核对;点击图片查看大图。

发一条非流式请求,直接读响应里的 usage

终端窗口
curl https://ai.roibest.com/v1/chat/completions \
-H "Authorization: Bearer $ROIBEST_API_KEY" \
-H "Content-Type: application/json" \
-d '{"model":"your-model","messages":[{"role":"user","content":"hello"}]}'

返回体里的 usage.prompt_tokensusage.completion_tokens 应与用量明细中同一条记录一致。

费用和我按官方价算的对不上。 单价按模型所属服务分组配置,不等于厂商官方定价。以控制台展示的分组价格为准。

缓存命中的请求怎么算? 缓存相关 Token 在用量明细里单列。是否命中由模型与请求内容决定。

失败的请求扣费吗? 未产生上游调用的失败请求不计费,但会计入总请求数限流。已产生输出后中断的请求按实际产生的用量计费。

额度用完了会怎样。 请求被拒绝并提示额度不足。到控制台充值,或调高该密钥的额度上限。

ROIBest AI 文档