AI联奕 AI 中台
帮助中心消息
AI中台管理 / 模型管理 / 统计分析

统计分析

面向校级 AI 中台的模型调用、资源消耗与服务质量分析

数据截至 2026-09-04 09:30 · 筛选后自动刷新
总调用量
1,284,392
↑ 12.6% 较上一周期
AI资源消耗
8.72亿 Token
↑ 21.3% 较上一周期
活跃模型
18
统计周期内发生调用
活跃接入方
36
统计周期内发生调用
调用成功率
99.82%
↓ 0.05% 较上一周期
P95 响应时间
3.2s
↑ 0.4s 较上一周期

调用趋势

调用规模与消耗变化,点击时间点可查看当日明细

8月29日8月30日8月31日9月1日9月2日9月3日9月4日
峰值调用9月3日 20.2万次
日均调用18.3万次
较上一周期+12.6%

模型调用排行

按调用量排序 · Top 5

  1. 01
    Qwen3.5
    文本生成 · 42.3万次 · 32.9%
    3.2亿Token
  2. 02
    DeepSeek
    文本生成 · 31.8万次 · 24.8%
    2.7亿Token
  3. 03
    Qwen Embedding
    文本向量 · 28.1万次 · 21.9%
    0.8亿Token
  4. 04
    Qwen Rerank
    文本重排 · 15.7万次 · 12.2%
    15.7万请求
  5. 05
    FLUX.1
    图像生成 · 2.4万次 · 1.9%
    3.6万

接入方调用排行

按调用量排序 · Top 5

  1. 01
    校级超级智能体
    38.2万次 · 29.7% · 使用4个模型
    2.9亿Token
  2. 02
    AI知识助手
    21.4万次 · 16.7% · 使用3个模型
    1.8亿Token
  3. 03
    科研助手
    18.6万次 · 14.5% · 使用2个模型
    1.4亿Token
  4. 04
    教务系统
    12.7万次 · 9.9% · 使用3个模型
    0.9亿Token
  5. 05
    智能问数
    8.3万次 · 6.5% · 使用2个模型
    0.6亿Token

模型调用分布

Top 3 模型及其他模型的调用占比

调用量128.4万
  • Qwen3.532.9%
  • DeepSeek24.8%
  • Qwen Embedding21.9%
  • 其他20.4%

AI能力使用分布

以调用量统计;悬停可查看对应资源计量

调用量128.4万
  • 文本生成71.0%
  • 文本向量22.0%
  • 文本重排5.0%
  • 图像生成及其他2.0%

服务质量

从成功率、响应速度与异常结构评估服务稳定性

8月29日8月30日8月31日9月1日9月2日9月3日9月4日
失败请求2,312 · 失败率 0.18%
请求超时1,126
模型服务异常754
触发限流246
其他异常186

运营洞察

基于当前筛选范围识别出的重点变化

资源增长

消耗较日均值增长 42%

主要来自“校级超级智能体”的文本生成调用。

提醒 · 调用异常

科研助手增长 186%

今日调用量相较昨日明显增长,建议关注使用场景。

警告 · 性能下降

DeepSeek 响应变慢

P95 响应时间由 3.2s 上升至 6.8s。

警告 · 服务异常

教务系统失败率 8.7%

过去1小时以请求超时为主要错误类型。

资源集中

Qwen3.5 承担 67%

当前平台文本生成调用集中度较高。

模型分析

聚焦模型使用规模、资源效率与服务表现

活跃模型
18
统计周期内有调用
总调用量
128.4万次
↑ 12.6%
AI资源消耗
8.72亿 Token
↑ 21.3%
平均成功率
99.82%
↓ 0.05%
平均P95
3.2s
↑ 0.4s

模型调用趋势

选中模型后同步查看调用量、资源消耗与成功率

8月29日8月31日9月1日9月3日9月4日

模型服务表现

优先关注失败率与P95响应时间异常

  1. 01
    DeepSeek
    成功率 99.63% · P95 6.8s
    1,177失败请求
  2. 02
    Qwen3.5
    成功率 99.91% · P95 2.8s
    381失败请求
  3. 03
    Qwen Rerank
    成功率 99.74% · P95 1.2s
    206失败请求
性能提醒DeepSeek 的 P95 响应时间较上一周期增加 2.1s。

模型资源消耗排行

按当前能力的实际计量单位分别展示

  1. 01
    Qwen3.5
    文本生成 · 调用占比 32.9%
    3.2亿Token
  2. 02
    DeepSeek
    文本生成 · 调用占比 24.8%
    2.7亿Token
  3. 03
    FLUX.1
    图像生成 · 调用占比 1.9%
    3.6万

实例调用分布

模型实例为下钻维度,不作为首页资产指标

qwen3.5-prod-0118.7万次 · 成功率99.94%
P95 2.6s
qwen3.5-prod-0215.2万次 · 成功率99.89%
P95 3.1s
deepseek-prod-0120.4万次 · 成功率99.60%
P95 6.9s
deepseek-prod-0211.4万次 · 成功率99.67%
P95 6.6s

模型统计表

点击模型名称可进入模型统计详情;支持排序与分页

模型名称能力类型调用量调用占比资源消耗接入方数量成功率P95响应时间
文本生成42.3万32.9%3.2亿 Token1699.91%2.8s
文本生成31.8万24.8%2.7亿 Token1299.63%6.8s
文本向量28.1万21.9%0.8亿 Token999.96%0.7s

接入方分析

分析各系统、应用和智能体的AI服务使用与稳定性

活跃接入方
36
统计周期内有调用
总调用量
128.4万次
↑ 12.6%
AI资源消耗
8.72亿 Token
↑ 21.3%
平均成功率
99.82%
↓ 0.05%
平均P95
3.2s
↑ 0.4s

接入方调用趋势

查看特定系统的调用规模、资源消耗与成功率

8月29日8月31日9月1日9月3日9月4日

模型使用覆盖

已接入模型与能力类型分布

使用模型18个活跃模型
文本生成24个接入方
向量检索11个接入方
资源集中校级超级智能体占总调用量29.7%,使用4个模型。

接入方资源消耗排行

以当前能力的对应资源单位展示

  1. 01
    校级超级智能体
    38.2万次 · 使用4个模型
    2.9亿Token
  2. 02
    AI知识助手
    21.4万次 · 使用3个模型
    1.8亿Token
  3. 03
    科研助手
    18.6万次 · 使用2个模型
    1.4亿Token

接入方服务质量

按失败请求数定位需要关注的调用方

  1. 01
    教务系统
    失败率 8.7% · 主要异常:请求超时
    1,024失败请求
  2. 02
    科研助手
    失败率 0.64% · 主要异常:模型服务异常
    447失败请求
  3. 03
    AI知识助手
    失败率 0.18% · 主要异常:触发限流
    196失败请求

接入方统计表

支持排序、分页与进入接入方统计详情

接入方名称调用量调用占比资源消耗使用模型数量成功率P95响应时间最近调用时间
38.2万29.7%2.9亿 Token499.92%2.7s2026-09-04 09:29
21.4万16.7%1.8亿 Token399.82%3.5s2026-09-04 09:28
18.6万14.5%1.4亿 Token299.36%4.2s2026-09-04 09:27
12.7万9.9%0.9亿 Token391.30%7.1s2026-09-04 09:28

服务质量

查看整体稳定性与异常请求结构

总体成功率
99.82%
失败请求数
2,312
P95响应时间
3.2s
平均首Token时间
0.8s

异常模型与接入方

按失败请求数排序;可继续进入调用明细

当前筛选范围内,请求超时为主要异常类型,共 1,126 次。