用量

工作区用量与性能分析,每 5 分钟刷新。分 概览用量明细 两个标签,支持按 时间范围、API Key、成员 筛选。

概览页

核心指标卡:已用额度、Token 总量、延迟、缓存命中率、总请求数(额度可按档位切换)。

图表区

  • Token 用量概览:按日期、按模型堆叠展示 Token 消耗。
  • 延迟 (p95):展示延迟分布(快速 / 缓慢)。
  • 缓存命中率:环形图显示命中率及今日节省 tokens。
  • 排行榜:热门 API Key(请求数、Token 数)、热门成员(额度)、热门模型(用量占比)。
用量分析

用量明细页

切换到 用量明细 标签页,可逐条查看每次 API 调用的详细记录。

顶部筛选

  • 时间范围:默认「最近 30 天」,可下拉切换「最近 7 天」「最近 24 小时」。
  • API Key:默认「全部 API Key」,可下拉按指定 Key 过滤。

用量记录表(各列含义)

  • 时间:调用发起时间(月-日 时:分)。
  • 用户:发起调用的用户名。
  • API Key:所用 Key 的名称/别名。
  • 模型:调用的模型(名称部分脱敏,如 Te***-Embedding-3-Large)。
  • 输入 Token:请求消耗的输入 Token 数。
  • 输出 Token:模型返回的输出 Token 数。
  • 缓存读取:命中缓存读取的 Token 数。
  • 额度:本次调用扣除的费用/额度。
  • 延迟:本次请求耗时(秒)。
  • 状态:调用结果状态(如 POSTED 表示已记账)。
用量明细