跳转至

用量

dashboard 跟踪你 API key 的请求量、token 用量与成本。本页文档记录 dashboard 报告的 字段及其背后的 API 接口,以便你在监控或预算用量时了解所测内容。

跟踪指标

用量统计——总请求数、总 token(输入/输出)、总费用与平均耗时,可按模型、API key、日期范围筛选。

账单余额——Credits 余额、今日/本月消费与账户速率限制。

字段 说明
总请求数 跨所有 key 的累计请求计数。
今日请求数 当日(服务器时区)请求计数。
输入 token 按模型输入费率计费的 prompt token。
输出 token 按模型输出费率计费的生成 token。
缓存创建 token 写入 prompt 缓存的 token(缓存写)。
缓存读取 token 从 prompt 缓存服务的 token(缓存读)。
总 token 输入 + 输出 + 缓存 token 之和。
成本 按模型列表费率计费的成本。
实际成本 应用有效费率倍率(组/模型折扣)后的成本。
RPM 每分钟请求数。
TPM 每分钟 token 数。
平均时长 平均请求延迟(毫秒)。
活跃 API key 至少发起一次请求的 key。
总 API key 账户上所有 key。

缓存读取 token 按低于输入 token 的费率计费(见模型定价)。 成本实际成本的区别反映了列表价格之后应用的每模型费率倍率。

API 接口

dashboard 从你 base URL 下的两个端点读取:

  • GET /api/v1/usage/dashboard/stats — 聚合总量与今日数据(请求、token、成本、 RPM/TPM、平均时长、key 计数)。
  • GET /api/v1/usage/dashboard/models — 相同指标的按模型分解。

两者需要 dashboard 登录的 bearer token(非 API key)。它们是只读的,面向 dashboard UI; 用于程序化监控时,查询与 dashboard 显示相同的字段。

监控与预算

  • 预算跟踪看实际成本而非成本——它反映折扣后实际计费。
  • 缓存读取 token 降低成本:高缓存读比意味着 prompt 命中 prompt 缓存。调整 prompt 前缀 稳定性以提高此比率。
  • RPM 与 TPM 受账户速率限制与并发配额约束,在 dashboard 可见。联系支持以提升限制。