深色模式
计费与用量说明
余额如何扣除
每次 API 请求成功后,系统根据以下公式计算费用:
实际费用 = (输入 Token 数 × 输入单价 + 输出 Token 数 × 输出单价) × 模型倍率计费结果以控制台的使用记录为准。仅凭 HTTP 状态码不能断定是否扣费;如果失败请求产生了异常扣费,请保留请求时间和记录并联系客服核验。
实际价格以控制台为准
模型单价和倍率会随上游调整,文档不列固定价格表。 请在控制台"模型列表"或"计费说明"页面查看当前费率。
模型倍率是什么
倍率是 Drivecode API 对不同模型设置的价格系数。倍率越高,相同 Token 数消耗的余额越多。
示例:倍率 1.0 的模型和倍率 2.0 的模型相比,后者消耗余额是前者的两倍。
Token 类型说明
- 输入 Token — 你发送给模型的内容(提示词、历史对话、系统提示等)换算成的 Token 数
- 输出 Token — 模型返回内容换算成的 Token 数,通常比输入贵
- 缓存写入 Token — 部分模型支持 Prompt Cache,首次写入缓存时计费
- 缓存读取 Token — 命中已缓存的内容,费用低于普通输入 Token
为什么同样一句话,不同模型消费差别很大?
- 不同模型的 Token 单价不同(Claude Opus > Claude Sonnet > Claude Haiku)
- 同一模型对中文和英文的 Token 分词结果不同,中文通常消耗更多 Token
- 长上下文对话会累积大量输入 Token
在"使用记录"页面查看消费
进入 使用记录页面 可以查看:
- 请求时间 — 发送请求的时间戳
- 模型 — 本次请求使用的模型名称
- 输入 Token — 本次请求消耗的输入 Token 数
- 输出 Token — 本次请求消耗的输出 Token 数
- 扣费 — 本次请求实际扣除的余额
- 状态 — 请求是否成功
发现异常消费怎么办?
- 记录异常的请求时间和扣费金额
- 进入"API 密钥"页面禁用相关密钥
- 联系客服说明情况
控制消费的建议
- 开发调试时使用低倍率的小模型(从
/v1/models获取模型列表后选择性价比高的模型) - 设置合理的输出上限,避免模型输出过长:Responses 使用
max_output_tokens,Chat Completions 使用max_completion_tokens,Anthropic Messages 使用max_tokens - 避免在循环中高频调用 API,容易快速消耗余额
- 流式请求(Streaming)与非流式请求在 Token 计费上相同