管理员工作台
「管理员工作台」是平台管理员的运营驾驶舱,集中展示 GPU 利用率、资源消耗、模型调用、LLM 费用等核心 KPI,以及资源池配额、运行中负载、调用 Top 榜和资源/调用趋势图。
入口路径:左侧菜单 AI 智算管理 > AI 资产管理 > 管理员工作台,页面路由
/admin/ai/manage/workbench。

页面功能
| 区域 | 说明 |
|---|---|
| 核心 KPI | GPU 利用率、资源消耗、运行中服务和任务、在线推理服务、模型调用、LLM 费用 |
| GPU 配额余量 | 共享/独享/超分/预留四类资源池的算力与显存水位 |
| 运行中服务·任务 | 8 类工作负载的实时运行清单 |
| 模型调用 Top 5 | 按调用数排序的热门模型 |
| 用户/API Key 调用 Top 5 | 按用户或 API Key 维度排序的调用排行 |
| 资源趋势图 | 各资源池的算力/显存分配率与使用率趋势 |
| 模型/Token 调用趋势 | 按模型维度的调用次数与 Token 用量趋势 |
查看核心 KPI
- 进入 AI 智算管理 > AI 资产管理 > 管理员工作台。
- 页面顶部展示 6 项核心 KPI 卡片:
- GPU 利用率:当前集群 GPU 整体利用率。
- 资源消耗:按计费口径统计的累计资源消耗。
- 运行中服务和任务:当前运行中的服务与任务总数。
- 在线推理服务:当前在线的推理服务数量。
- 模型调用:统计周期内的模型调用总次数。
- LLM 费用:统计周期内的 LLM 调用费用。
- 将鼠标悬停在 KPI 数值上,部分卡片会展示更详细的口径说明或环比变化。

查看 GPU 配额余量
- 在页面中部的「GPU 配额余量」面板,按资源池类型分为四组:
- 共享:多租户共享使用的 GPU 资源池。
- 独享:分配给单一租户的 GPU 资源池。
- 超分:开启超分能力的 GPU 资源池。
- 预留:预留的整卡资源池。
- 每组展示算力与显存的已用/总量+进度条;预留组额外展示整卡数与显存。
- 点击某资源池卡片,可下钻查看该池的显卡明细或租户配额分布(若支持)。

查看运行中负载
- 在「运行中服务·任务」表格中,聚合展示 8 类工作负载:
- 训练任务、微调任务、评测任务、推理服务、自定义服务、容器实例、数据清洗、数据增强。
- 表格列:类型/芯片、名称、创建人、状态、运行时长。
- 点击表格行内的名称,可跳转到对应资源的详情页进行管理。
- 使用表格上方的类型筛选或搜索框,快速定位某类负载。

查看调用 Top 榜
模型调用 Top 5
- 在「模型调用 Top 5」表格中,基于 ClickHouse 调用日志按真实调用数排序。
- 表格列:模型、调用次数、Tokens、费用。
- 点击模型名称可跳转模型详情或调用记录页。
用户/API Key 调用 Top 5
- 在「用户/API Key 调用 Top 5」表格上方,切换维度:
- 用户:按用户维度聚合调用量。
- API Key:API Key 脱敏展示为
sk-••••后8位。
- 表格列:用户或 API Key、调用次数、Tokens、费用。
- 点击用户名称或 API Key 可跳转调用记录详情。

查看资源趋势
- 在「资源趋势图」区域,通过 Tab 切换共享/独享/超分资源池。
- 每池展示 4 条曲线:
- 算力分配率
- 算力使用率
- 显存分配率
- 显存使用率
- 按天粒度展示水位,鼠标悬停可查看具体日期的数值。
- 使用图例点击可隐藏/显示某条曲线。

查看模型/Token 调用趋势
- 在「模型/Token 调用」趋势图区域,通过 Tab 切换:
- 调用次数:按模型维度展示调用次数趋势。
- Token 用量:按模型维度展示 Token 用量趋势。
- 图表按 Top 3 模型 + 其他堆叠展示,便于识别主力调用模型。
- 客户端切换 Tab 时不重新拉取数据,保证交互流畅。

常见问题
Q:管理员工作台的数据多久刷新一次? A:KPI 卡片和 Top 榜通常按分钟级刷新;资源趋势和调用趋势按天汇总,每日更新。
Q:为什么某些 KPI 显示为 0 或「--」? A:可能原因包括:当前集群未接入 GPU 监控、未启用 LLM 调用计费、或该统计周期内无相关数据。
Q:管理员工作台是否只能平台管理员查看? A:默认仅平台管理员和租户管理员可见;具体权限可在「集群管理 > 用户与角色」中配置。
Q:运行中负载表格中的任务可以在这里直接停止吗? A:工作台主要用于展示,如需停止或释放任务,点击名称跳转至对应管理页面执行操作。