Skip to content

计费与用量说明

余额如何扣除

每次 API 请求成功后,系统根据以下公式计算费用:

实际费用 = (输入 Token 数 × 输入单价 + 输出 Token 数 × 输出单价) × 模型倍率

计费结果以控制台的使用记录为准。仅凭 HTTP 状态码不能断定是否扣费;如果失败请求产生了异常扣费,请保留请求时间和记录并联系客服核验。

实际价格以控制台为准

模型单价和倍率会随上游调整,文档不列固定价格表。 请在控制台"模型列表"或"计费说明"页面查看当前费率。

模型倍率是什么

倍率是 Drivecode API 对不同模型设置的价格系数。倍率越高,相同 Token 数消耗的余额越多。

示例:倍率 1.0 的模型和倍率 2.0 的模型相比,后者消耗余额是前者的两倍。

Token 类型说明

  • 输入 Token — 你发送给模型的内容(提示词、历史对话、系统提示等)换算成的 Token 数
  • 输出 Token — 模型返回内容换算成的 Token 数,通常比输入贵
  • 缓存写入 Token — 部分模型支持 Prompt Cache,首次写入缓存时计费
  • 缓存读取 Token — 命中已缓存的内容,费用低于普通输入 Token

为什么同样一句话,不同模型消费差别很大?

  • 不同模型的 Token 单价不同(Claude Opus > Claude Sonnet > Claude Haiku)
  • 同一模型对中文和英文的 Token 分词结果不同,中文通常消耗更多 Token
  • 长上下文对话会累积大量输入 Token

在"使用记录"页面查看消费

进入 使用记录页面 可以查看:

  • 请求时间 — 发送请求的时间戳
  • 模型 — 本次请求使用的模型名称
  • 输入 Token — 本次请求消耗的输入 Token 数
  • 输出 Token — 本次请求消耗的输出 Token 数
  • 扣费 — 本次请求实际扣除的余额
  • 状态 — 请求是否成功

发现异常消费怎么办?

  1. 记录异常的请求时间和扣费金额
  2. 进入"API 密钥"页面禁用相关密钥
  3. 联系客服说明情况

控制消费的建议

  • 开发调试时使用低倍率的小模型(从 /v1/models 获取模型列表后选择性价比高的模型)
  • 设置合理的输出上限,避免模型输出过长:Responses 使用 max_output_tokens,Chat Completions 使用 max_completion_tokens,Anthropic Messages 使用 max_tokens
  • 避免在循环中高频调用 API,容易快速消耗余额
  • 流式请求(Streaming)与非流式请求在 Token 计费上相同

本文档仅供 Drivecode API 用户参考,不代表任何 AI 模型服务商官方立场。