总调用量
1,284,392次
↑ 12.6% 较上一周期
面向校级 AI 中台的模型调用、资源消耗与服务质量分析
调用规模与消耗变化,点击时间点可查看当日明细
按调用量排序 · Top 5
按调用量排序 · Top 5
Top 3 模型及其他模型的调用占比
以调用量统计;悬停可查看对应资源计量
从成功率、响应速度与异常结构评估服务稳定性
基于当前筛选范围识别出的重点变化
主要来自“校级超级智能体”的文本生成调用。
今日调用量相较昨日明显增长,建议关注使用场景。
P95 响应时间由 3.2s 上升至 6.8s。
过去1小时以请求超时为主要错误类型。
当前平台文本生成调用集中度较高。
聚焦模型使用规模、资源效率与服务表现
选中模型后同步查看调用量、资源消耗与成功率
优先关注失败率与P95响应时间异常
按当前能力的实际计量单位分别展示
模型实例为下钻维度,不作为首页资产指标
点击模型名称可进入模型统计详情;支持排序与分页
| 模型名称 | 能力类型 | 调用量 | 调用占比 | 资源消耗 | 接入方数量 | 成功率 | P95响应时间 |
|---|---|---|---|---|---|---|---|
| 文本生成 | 42.3万 | 32.9% | 3.2亿 Token | 16 | 99.91% | 2.8s | |
| 文本生成 | 31.8万 | 24.8% | 2.7亿 Token | 12 | 99.63% | 6.8s | |
| 文本向量 | 28.1万 | 21.9% | 0.8亿 Token | 9 | 99.96% | 0.7s |
分析各系统、应用和智能体的AI服务使用与稳定性
查看特定系统的调用规模、资源消耗与成功率
已接入模型与能力类型分布
以当前能力的对应资源单位展示
按失败请求数定位需要关注的调用方
支持排序、分页与进入接入方统计详情
| 接入方名称 | 调用量 | 调用占比 | 资源消耗 | 使用模型数量 | 成功率 | P95响应时间 | 最近调用时间 |
|---|---|---|---|---|---|---|---|
| 38.2万 | 29.7% | 2.9亿 Token | 4 | 99.92% | 2.7s | 2026-09-04 09:29 | |
| 21.4万 | 16.7% | 1.8亿 Token | 3 | 99.82% | 3.5s | 2026-09-04 09:28 | |
| 18.6万 | 14.5% | 1.4亿 Token | 2 | 99.36% | 4.2s | 2026-09-04 09:27 | |
| 12.7万 | 9.9% | 0.9亿 Token | 3 | 91.30% | 7.1s | 2026-09-04 09:28 |
查看整体稳定性与异常请求结构
按失败请求数排序;可继续进入调用明细