LLM Inference Dashboard (SGLang / vLLM)
同时支持 SGLang 和 vLLM 的统一 LLM 推理监控 Grafana Dashboard,数据源为 Prometheus。该模板将两类推理后端的可比指标放在同一视图中展示,覆盖请求量、Token 吞吐、延迟分位数、队列状态、缓存行为以及 Engine 或 TP Rank 维度的分布情况。适用于混合推理集群、后端迁移、压测对比和统一运维场景,帮助团队用一致的视角观察不同推理框架的服务表现。
同时支持 SGLang 和 vLLM 的统一 LLM 推理监控 Grafana Dashboard,数据源为 Prometheus。该模板将两类推理后端的可比指标放在同一视图中展示,覆盖请求量、Token 吞吐、延迟分位数、队列状态、缓存行为以及 Engine 或 TP Rank 维度的分布情况。适用于混合推理集群、后端迁移、压测对比和统一运维场景,帮助团队用一致的视角观察不同推理框架的服务表现。
Data source config
Collector type:
Collector plugins:
Collector config:
Revisions
Upload an updated version of an exported dashboard.json file from Grafana
| Revision | Description | Created | |
|---|---|---|---|
| Download |