同时支持 SGLang 和 vLLM 的统一 LLM 推理监控 Grafana Dashboard,数据源为 Prometheus。该模板将两类推理后端的可比指标放在同一视图中展示,覆盖请求量、Token 吞吐、延迟分位数、队列状态、缓存行为以及 Engine 或 TP Rank 维度的分布情况。适用于混合推理集群、后端迁移、压测对比和统一运维场景,帮助团队用一致的视角观察不同推理框架的服务表现。