用量与费用分析
最近更新:2026年9月15日
用量页与费用页各自回答什么问题、可用的拆分维度,以及与账单口径的关系。
控制台提供两个分析页面,回答的问题不同:
| 页面 | 回答 |
|---|---|
| 用量 | 调用了多少——请求数与各类 token 的分布 |
| 费用 | 花了多少钱——金额如何在模型、密钥与计费项之间分摊 |
两者共用同一份数据源,均从日聚合表读取,因此翻看长区间不会变慢。
用量
指标
| 指标 | 含义 |
|---|---|
| 总 Token 用量 | 输入、输出、缓存读、缓存写四项之和 |
| 输入 / 输出 Token | 提示词与模型生成的 token |
| 缓存读 / 写 Token | 命中缓存与写入缓存的 token |
| API 请求总数 | 该区间内的调用次数 |
各上游供应商的 usage 字段中没有统一的「总数」,且口径不一致,因此总量由平台按上述四项相加得出。
拆分维度
- 按模型 —— 哪些模型消耗了多少 token
- 按 API 密钥 —— 哪把密钥消耗了多少,这是归因到项目的主要方式
- 按工作区 —— 组织视图下可见,用于比较各部门的消耗
- 按成员 —— 工作区视图下可按成员筛选
费用
指标
| 指标 | 含义 |
|---|---|
| 总费用 | 该区间的全部支出 |
| 输入费用 / 输出费用 | 两大计费项各自的金额 |
| 其它费用 | 缓存读写与按次计费等其余项 |
| 平均每请求 | 总费用 ÷ 请求数 |
| 平均每百万 Token | 总费用 ÷ token 总量,用于横向比较不同模型的实际成本 |
拆分维度
- 按模型 —— 钱花在哪些模型上
- 按计费类型 —— 输入、输出、缓存读、缓存写、推理、按次等各占多少
- 按 API 密钥 —— 归因到项目
- 按工作区 —— 组织视图下的部门分摊
「按计费类型」通常是优化成本时最先要看的一栏:缓存写入占比过高往往意味着缓存命中率低,而推理 token 占比过高则说明推理力度设置得高于实际需要。
与账单的关系
分析页与账单页口径一致:金额均为实际扣费。
不计费的部分不会出现在这里,包括上游报错的调用,以及路由故障转移中失败的尝试——这些成本由平台承担。完整口径见计费概览。
可见范围
| 角色 | 可见范围 |
|---|---|
| 组织主人 / 管理员 | 全组织,可按工作区与成员拆分 |
| 组织财务 | 全组织金额 |
| 工作区管理员 | 本工作区全部 |
| 工作区成员 | 仅本人 |
详见角色与权限。
归因的粒度取决于密钥划分
用量与费用按密钥统计,同一把密钥下的请求事后无法再拆分。 需要区分不同用途时,应在一开始就为每个用途创建独立的密钥。
共享密钥的调用还会按实际操作人记录,因此操练场等场景下仍能区分到具体成员;但通过 API 发起的调用只能归因到密钥。