Amux

用量与费用分析

最近更新:2026年9月15日

用量页与费用页各自回答什么问题、可用的拆分维度,以及与账单口径的关系。

控制台提供两个分析页面,回答的问题不同:

页面回答
用量调用了多少——请求数与各类 token 的分布
费用花了多少钱——金额如何在模型、密钥与计费项之间分摊

两者共用同一份数据源,均从日聚合表读取,因此翻看长区间不会变慢。

用量

指标

指标含义
总 Token 用量输入、输出、缓存读、缓存写四项之和
输入 / 输出 Token提示词与模型生成的 token
缓存读 / 写 Token命中缓存与写入缓存的 token
API 请求总数该区间内的调用次数

各上游供应商的 usage 字段中没有统一的「总数」,且口径不一致,因此总量由平台按上述四项相加得出。

拆分维度

  • 按模型 —— 哪些模型消耗了多少 token
  • 按 API 密钥 —— 哪把密钥消耗了多少,这是归因到项目的主要方式
  • 按工作区 —— 组织视图下可见,用于比较各部门的消耗
  • 按成员 —— 工作区视图下可按成员筛选

费用

指标

指标含义
总费用该区间的全部支出
输入费用 / 输出费用两大计费项各自的金额
其它费用缓存读写与按次计费等其余项
平均每请求总费用 ÷ 请求数
平均每百万 Token总费用 ÷ token 总量,用于横向比较不同模型的实际成本

拆分维度

  • 按模型 —— 钱花在哪些模型上
  • 按计费类型 —— 输入、输出、缓存读、缓存写、推理、按次等各占多少
  • 按 API 密钥 —— 归因到项目
  • 按工作区 —— 组织视图下的部门分摊

「按计费类型」通常是优化成本时最先要看的一栏:缓存写入占比过高往往意味着缓存命中率低,而推理 token 占比过高则说明推理力度设置得高于实际需要。

与账单的关系

分析页与账单页口径一致:金额均为实际扣费。

不计费的部分不会出现在这里,包括上游报错的调用,以及路由故障转移中失败的尝试——这些成本由平台承担。完整口径见计费概览

可见范围

角色可见范围
组织主人 / 管理员全组织,可按工作区与成员拆分
组织财务全组织金额
工作区管理员本工作区全部
工作区成员仅本人

详见角色与权限

归因的粒度取决于密钥划分

用量与费用按密钥统计,同一把密钥下的请求事后无法再拆分。 需要区分不同用途时,应在一开始就为每个用途创建独立的密钥。

共享密钥的调用还会按实际操作人记录,因此操练场等场景下仍能区分到具体成员;但通过 API 发起的调用只能归因到密钥。

相关