计费与用量核对
用量明细记录了哪些字段,以及怎么把一次调用和一笔费用对上。
This content is not available in your language yet.
按实际用量计费,无订阅门槛。余额不设有效期,未消耗部分持续可用。密钥可单独配置额度上限,用来隔离成员之间的用量。
计费方式随模型而定,可能是按 Token、按次、按图片或按视频。具体口径以模型所属服务分组和当前计费配置为准。
用量明细记录了什么
Section titled “用量明细记录了什么”控制台按请求逐条记录:
| 字段 | 内容 |
|---|---|
| 模型与分组 | 本次请求使用的模型、协议与服务分组 |
| Token 明细 | 输入、输出及缓存相关 Token |
| 计费方式与费用 | 区分 Token、按次、图片或视频等计费模式 |
| 请求类型与延迟 | 调用时间、接口类型与处理延迟 |
| 错误分类与状态 | 按密钥、模型、状态码和错误类别筛选 |
错误请求在独立的错误记录里查询,不与正常请求混在一起。
核对一次调用
Section titled “核对一次调用”- 记下发起请求的时间和使用的模型。
- 到控制台的用量明细里按时间和模型筛选,找到对应记录。
- 对比响应体里的
usage与记录中的 Token 明细。 - 费用等于 Token 数乘以该模型在该分组下的单价,或按次数计价。
流式请求要拿到响应体里的 usage,需在 OpenAI 协议下传 stream_options.include_usage。控制台的记录不依赖这个参数,始终完整。
发一条非流式请求,直接读响应里的 usage:
curl https://ai.roibest.com/v1/chat/completions \ -H "Authorization: Bearer $ROIBEST_API_KEY" \ -H "Content-Type: application/json" \ -d '{"model":"your-model","messages":[{"role":"user","content":"hello"}]}'返回体里的 usage.prompt_tokens 与 usage.completion_tokens 应与用量明细中同一条记录一致。
费用和我按官方价算的对不上。 单价按模型所属服务分组配置,不等于厂商官方定价。以控制台展示的分组价格为准。
缓存命中的请求怎么算? 缓存相关 Token 在用量明细里单列。是否命中由模型与请求内容决定。
失败的请求扣费吗? 未产生上游调用的失败请求不计费,但会计入总请求数限流。已产生输出后中断的请求按实际产生的用量计费。
额度用完了会怎样。 请求被拒绝并提示额度不足。到控制台充值,或调高该密钥的额度上限。
