OpenAI API 用量需要从三层核对:应用收到的单次响应 usage、Platform Usage 页面按组织和项目汇总的数据,以及账单或额度状态。把某个请求的 Token 直接当最终费用会漏掉缓存、工具、音频、图像和不同价格档位。
单次请求先保存哪些字段
每次调用至少记录内部任务 ID、模型、项目、时间、OpenAI request ID、输入与输出用量,以及是否调用工具。不要记录完整 API Key 或未经脱敏的用户内容。响应对象的具体 usage 字段应从Responses API 参考核对。

response = client.responses.create(
model="gpt-6-luna",
input="用一句话解释缓存。",
)
print("response id:", response.id)
print("input tokens:", response.usage.input_tokens)
print("output tokens:", response.usage.output_tokens)
如果响应没有预期字段,先保存 request ID 并检查 SDK 版本,不要把缺失值写成 0。示例只展示文字请求;工具、图片、音频和缓存需要读取对应明细。
在 Usage 页面按同一口径筛选
- 选择正确组织、项目和时区,缩小到请求发生的时间段。
- 若使用可追踪的项目 Key,按 API Key 或项目筛选,核对请求量和 Token。
- 把应用日志按同一时间范围聚合,解释重试、流式中断和失败请求。
- 再用官方价格页按模型、缓存和工具规则估算,与账单结果对比。
OpenAI 生产最佳实践说明了 Usage 页面、Key 跟踪和项目隔离。旧 Key 可能显示为未跟踪,用量也可能存在展示延迟,所以应用日志与平台数据应保留各自来源,不能强行凑成同一个即时数字。
对不上时怎样排查
| 差异 | 优先检查 |
|---|---|
| 平台比应用高 | 其他服务是否共用 Key、失败重试或工具费用是否漏记 |
| 应用比平台高 | 是否重复统计流式事件、时区或项目筛选是否错误 |
| 账单与 Token 估算不同 | 缓存读写、长上下文、图片音频和工具价格 |
本文没有读取你的组织、项目、余额或账单,也没有给出虚构用量。请用真实 response ID、项目筛选与官方账单完成对账;若差异无法解释,保留时间范围和 request ID 再联系官方支持。
Ai菜鸟网。发布者:AI小管家,转载请注明出处:https://www.alyyhw.com/31461.html