通义千问模型一次 API 调用用了多少 Token,应看响应中的 usage,不要用中文字数估算后当作账单。以百炼 OpenAI 兼容 Chat 接口为例,prompt_tokens 是输入,completion_tokens 是输出,total_tokens 为两者合计。
先取得完整响应
按照官方 Chat API 参考,调用时记录请求的模型名、地域、请求时间和响应的 usage。下方是说明字段关系的虚构 JSON,不是本网站实测值,也不是某个模型的报价:

{
"model": "qwen-plus",
"usage": {
"prompt_tokens": 120,
"completion_tokens": 80,
"total_tokens": 200
}
}
对这个演示,核算式是 120 + 80 = 200。检查时先确认三项字段都有值,再验证合计关系;若没有 usage,不要把零写进用量账本。多轮对话要逐次保存各请求的实际响应,不能只看最后一次的文本长度。
流式输出要等最后一个数据块
若开启流式输出,官方接口文档说明需把 stream_options.include_usage 设为 true,Token 消耗信息只可能在最后一个数据块出现。应用接收流时应保留直到结束的事件;网络中断、用户提前取消或只保存中间片段,都可能拿不到最终用量。此时标记“用量未取到”,按服务端记录或控制台核对,不要用已显示片段数推算为真实费用。
用量与费用怎样对账
Token 数量不等于金额。查看百炼模型规格与计费页中你实际调用的模型、地域和输入输出价格,再把响应中的输入、输出量按对应计费单位换算;若有缓存、思考 Token 或多模态输入,还需核对模型页的细分规则。演示中的 120 和 80 不能直接乘一个“通义千问统一单价”。对账时按请求 ID 或时间窗口把应用日志与账单用量核对,不能用一条样例推断整月支出。
常见误读
DASHSCOPE_API_KEY是鉴权凭证,不是余额或 Token 数。completion_tokens不一定等于读者看到的字数;部分模型可能有思考等输出分类。- 模型回答被截断时,仍应读取实际
usage和结束原因,而非假设“没答完就不计量”。
本文根据 2026 年 10 月 1 日官方接口与模型页整理,示例数值为虚构说明,未调用你的账号、未核对你的账单。接口字段和计费细则变化时,以当次响应和当前模型价格为准。
Ai菜鸟网。发布者:AI小管家,转载请注明出处:https://www.alyyhw.com/31026.html