Skip to main content
登录控制台后,您可以在 指标 页面查看模型调用的聚合指标和趋势数据。
  • 指标:适合用于观察一段时间内的整体调用情况、吞吐变化和延迟表现。
  • 首页:适合快速查看 Top Models、Top API Keys 和成员用量等主要调用来源;其中成员用量仅管理员可见。
  • 使用详情:适合查看单次请求的明细,请前往 使用详情 页面。

筛选维度

您可以按以下维度查看指标:
  • 时间范围:选择近 24 小时、近 7 天、近 30 天,或通过开始日期和结束日期自定义时间范围。
  • 模型:查看全部模型,或选择指定模型查看对应指标。

概览指标

概览指标 页面顶部会展示当前筛选条件下的汇总指标:

图表说明

指标 指标页面包含多类趋势和分布图,用于从不同角度分析调用情况:

常见分析路径

  • 分析成本变化:优先查看总 Tokens、TPM 和 Token 分布,判断成本增长主要来自输入、输出、推理还是缓存相关 token。
  • 排查响应变慢:优先查看首 Token 延迟(TTFT)和端到端延迟(E2E)。TTFT 偏高时重点关注首个 token 返回速度;E2E 偏高时重点关注输出长度和完整生成耗时。
  • 观察流量波动:结合 API 请求、RPM 和 TPM 判断调用峰值,必要时检查业务侧是否存在批量任务、定时任务或重试放大。
  • 优化 prompt 长度:查看 Prompt 长度分布。如果长 prompt 占比较高,可以考虑压缩上下文、拆分任务或复用缓存能力。
  • 对比模型表现:按模型筛选后查看延迟、吞吐和 token 分布,辅助判断不同模型是否适合当前业务场景。