New API 深度调用观测看板
Live
全面解构 Token、FRT(首字延迟)、TPS吞吐速率、上游渠道与缓存效率
过去 6 小时
过去 12 小时
过去 24 小时
过去 48 小时
过去 7 天
全部历史
所有模型 (全部)
所有渠道 (全部)
刷新
导出单文件HTML
总调用请求
0
成功率: 100%
总消费金额
$0.00
均次成本: $0.00
Token 总消耗
0
输入: 0 / 输出: 0
TTFT 首字延迟
0 ms
P50: 0ms | P95: 0ms
平均输出吞吐 (TPS)
0
tok/s
整句总耗时均值: 0s
端到端延时分位数
0s
P95: 0s | P99: 0s
Prompt Cache 命中率
0%
缓存命中 Tokens: 0
流式 (Stream) 占比
0%
打字机流式调用比例
活跃上游渠道数
0
健康路由策略覆盖中
覆盖模型种类
0
更新时间: --
各模型逐时分布走势
金额 ($)
Token 数量
逐时调用量 & 端到端平均延迟
负载与延时走势
模型消费金额占比
上游渠道分流与平均延时表现
Channel 负载均衡分析
模型多维性能与成本全景表
实时计算输出速率 (TPS) 与 Token 构成
模型名称
总请求数
消费 ($ USD)
总 Token
Prompt Tokens
Completion Tokens
平均延时 (s)
输出速率 (TPS)
流式比例