Skip to content

用量

查看 token 汇总、Session 数量和模型派发分布。

Updated View as Markdown

用量页面汇总当前应用运行期间记录的模型调用数据。

产品入口

在 Settings 的用量与统计区域查看:

  • 输入 tokens。
  • 输出 tokens。
  • Session 数量。
  • 模型派发次数。
  • 按模型统计的派发分布。

每条 Assistant 消息还会显示 TTFT、总耗时和输出速率,用于观察单次请求表现。

数据含义

token 汇总来自 kxen 记录的调用结果,不是 Provider 账单。Provider 的计费规则、缓存计费、免费额度和订阅配额仍以对应服务为准。

统计从当前应用启动开始累计。加载失败会显示错误,不会把缺失数据伪装成全零。

与路由的关系

模型派发分布反映 MRM 最终选择的模型。发生 fallback 时,统计落在实际执行请求的模型上,而不是最初请求的角色绑定。

Navigation

Type to search…

↑↓ navigate↵ selectEsc close