Datadog Dashboards

대시보드

총 16개
필터는 바로 적용됩니다
이름인기작성자변환 품질최근 수정
Nvidia GPU Metricsnvidianvidia-sminvidia_gpu_exporter

Nvidia GPU Metrics based on the prometheus metrics from github.com/utkuozdemir/nvidia_gpu_exporter

0
0
utkuozdemir좋음
Nvidia GPU Metricsnvidianvidia-sminvidia_gpu_exporter

Nvidia GPU Metrics based on the prometheus metrics from github.com/utkuozdemir/nvidia_gpu_exporter

0
0
livewalk좋음
AI智算-GPU资源监控概览-20241127a100a800h100

适用于AI智算场景中监控NVIDIA GPU资源概览,依赖组件: dcgm-exporter:3.3.0-3.2.0-ubuntu22.04、prometheus:v2.39.1、grafana:10.3.3

0
0
hughyw보통
nvitop-dashboardnvitopnvitop-exporterprometheus

Grafana Dashboard built by `nvitop-exporter`.

0
0
xuehaipan좋음
Nvidia GPU监控面板nvidianvidia-sminvidia_gpu_exporter

Nvidia GPU监控中文面板,支持根据主机和UUID检索。Exporter地址:github.com/utkuozdemir/nvidia_gpu_exporter

0
0
dotbalo좋음
Nvidianvidianvidia-sminvidia_gpu_exporter

Nvidia GPU Metrics based on the prometheus metrics from github.com/utkuozdemir/nvidia_gpu_exporter

0
0
black1996좋음
Nvidia GPU Metricsnvidianvidia-sminvidia_gpu_exporter

Nvidia GPU Metrics based on the prometheus metrics from github.com/utkuozdemir/nvidia_gpu_exporter

0
0
ntzikayo좋음
Nvidia GPU Metricsnvidianvidia-sminvidia_gpu_exporter

Nvidia GPU Metrics based on the prometheus metrics from github.com/utkuozdemir/nvidia_gpu_exporter

0
0
c110137126좋음
Nvidia GPU Overviewnvidianvidia-sminvidia_gpu_exporter

Compare all GPUs of one node side by side: current state, utilization, thermals, throttling and health per GPU. Companion to the Nvidia GPU Metrics dashboard (single-GPU detail, click a GPU in the table to drill down). Shows physical GPUs as reported by nvidia-smi, MIG instances are not broken out: rows are the parent GPUs, whose utilization is not reported in MIG mode and shows n/a. Based on the prometheus metrics from github.com/utkuozdemir/nvidia_gpu_exporter

0
0
utkuozdemir보통
Neurix — Ollama & NVIDIA GPUollamagpunvidia

Ollama LLM runtime metrics — models, VRAM, GPU telemetry, process stats. Requires Neurix ollama_exporter.

0
0
diyrex좋음
DC OverViewprometheusenvidialinux

dc overview

0
0
markzleo좋음
NVIDIA GPU for AI Workloads — Efficiency, Cost & Health (DCGM)gpunvidiadcgm

GPU monitoring for self-hosted AI: are your tensor cores actually working, what does each run cost in kWh, and is your VRAM degrading? Built and battle-tested on a local LLM rig (100B+ parameter models). Requires dcgm-exporter with DCP/profiling metrics enabled. Multi-GPU via UUID variable.

0
0
orangeoctopus1069좋음
Jetson Orin Exporter - jtopjetsonnvidiaorin

Comprehensive monitoring dashboard for NVIDIA Jetson Orin devices using metrics from the jtop Prometheus exporter. Covers GPU utilization, unified memory, per-core CPU usage and frequency, thermal zones, power consumption breakdown, GPU/EMC frequency scaling, swap, fan speed, hardware engine status (DLA, NVENC, NVDEC), disk usage, and board info. Requires a jtop-based Prometheus exporter exposing jetson_* metrics.

0
0
pgodlews좋음
NVIDIA GPU Operator & DCGM Observabilityk8snvidiagpu-operator

Live NVIDIA GPU Operator and DCGM exporter observability. Covers all 23 active DCGM metric families and GPU Operator health metrics; every panel has a Grafana hover-info description.

0
0
nafey1보통
Linux Host with NVIDIA GPU - Node Exporterlinuxnode-exporterubuntu

Linux Host Monitoring with NVIDIA GPU - Node Exporter + nvidia_gpu_exporter

0
0
fortnexai좋음
Nvidia GPU Metricsnvidianvidia-sminvidia_gpu_exporter

Nvidia GPU Metrics based on the prometheus metrics from github.com/utkuozdemir/nvidia_gpu_exporter

0
0
WanTanCorp좋음