用量¶
dashboard 跟踪你 API key 的请求量、token 用量与成本。本页文档记录 dashboard 报告的 字段及其背后的 API 接口,以便你在监控或预算用量时了解所测内容。
跟踪指标¶


| 字段 | 说明 |
|---|---|
| 总请求数 | 跨所有 key 的累计请求计数。 |
| 今日请求数 | 当日(服务器时区)请求计数。 |
| 输入 token | 按模型输入费率计费的 prompt token。 |
| 输出 token | 按模型输出费率计费的生成 token。 |
| 缓存创建 token | 写入 prompt 缓存的 token(缓存写)。 |
| 缓存读取 token | 从 prompt 缓存服务的 token(缓存读)。 |
| 总 token | 输入 + 输出 + 缓存 token 之和。 |
| 成本 | 按模型列表费率计费的成本。 |
| 实际成本 | 应用有效费率倍率(组/模型折扣)后的成本。 |
| RPM | 每分钟请求数。 |
| TPM | 每分钟 token 数。 |
| 平均时长 | 平均请求延迟(毫秒)。 |
| 活跃 API key | 至少发起一次请求的 key。 |
| 总 API key | 账户上所有 key。 |
缓存读取 token 按低于输入 token 的费率计费(见模型定价)。
成本与实际成本的区别反映了列表价格之后应用的每模型费率倍率。
API 接口¶
dashboard 从你 base URL 下的两个端点读取:
GET /api/v1/usage/dashboard/stats— 聚合总量与今日数据(请求、token、成本、 RPM/TPM、平均时长、key 计数)。GET /api/v1/usage/dashboard/models— 相同指标的按模型分解。
两者需要 dashboard 登录的 bearer token(非 API key)。它们是只读的,面向 dashboard UI; 用于程序化监控时,查询与 dashboard 显示相同的字段。
监控与预算¶
- 预算跟踪看
实际成本而非成本——它反映折扣后实际计费。 - 缓存读取 token 降低成本:高缓存读比意味着 prompt 命中 prompt 缓存。调整 prompt 前缀 稳定性以提高此比率。
- RPM 与 TPM 受账户速率限制与并发配额约束,在 dashboard 可见。联系支持以提升限制。