用量页面汇总当前应用运行期间记录的模型调用数据。
产品入口
在 Settings 的用量与统计区域查看:
- 输入 tokens。
- 输出 tokens。
- Session 数量。
- 模型派发次数。
- 按模型统计的派发分布。
每条 Assistant 消息还会显示 TTFT、总耗时和输出速率,用于观察单次请求表现。
数据含义
token 汇总来自 kxen 记录的调用结果,不是 Provider 账单。Provider 的计费规则、缓存计费、免费额度和订阅配额仍以对应服务为准。
统计从当前应用启动开始累计。加载失败会显示错误,不会把缺失数据伪装成全零。
与路由的关系
模型派发分布反映 MRM 最终选择的模型。发生 fallback 时,统计落在实际执行请求的模型上,而不是最初请求的角色绑定。