New API 深度调用观测看板 Live

全面解构 Token、FRT(首字延迟)、TPS吞吐速率、上游渠道与缓存效率

总调用请求
0
成功率: 100%
总消费金额
$0.00
均次成本: $0.00
Token 总消耗
0
输入: 0 / 输出: 0
TTFT 首字延迟
0 ms
P50: 0ms | P95: 0ms
平均输出吞吐 (TPS)
0 tok/s
整句总耗时均值: 0s
端到端延时分位数
0s
P95: 0s | P99: 0s
Prompt Cache 命中率
0%
缓存命中 Tokens: 0
流式 (Stream) 占比
0%
打字机流式调用比例
活跃上游渠道数
0
健康路由策略覆盖中
覆盖模型种类
0
更新时间: --

各模型逐时分布走势

逐时调用量 & 端到端平均延迟

负载与延时走势

模型消费金额占比

上游渠道分流与平均延时表现

Channel 负载均衡分析

模型多维性能与成本全景表

实时计算输出速率 (TPS) 与 Token 构成
模型名称 总请求数 消费 ($ USD) 总 Token Prompt Tokens Completion Tokens 平均延时 (s) 输出速率 (TPS) 流式比例