<?xml version="1.0" encoding="utf-8" standalone="yes"?><rss version="2.0" xmlns:atom="http://www.w3.org/2005/Atom"><channel><title>Nvidia GPU on Netdata</title><link>https://www.netdata.cloud/tags/nvidia-gpu/</link><description>Recent content in Nvidia GPU on Netdata</description><generator>Hugo</generator><language>en-us</language><lastBuildDate>Sat, 22 Aug 2026 05:09:03 +0300</lastBuildDate><atom:link href="https://www.netdata.cloud/tags/nvidia-gpu/index.xml" rel="self" type="application/rss+xml"/><item><title>NVIDIA DCGM Collector: Deep GPU Monitoring For AI</title><link>https://www.netdata.cloud/blog/nvidia-dcgm-monitoring/</link><pubDate>Mon, 04 May 2026 00:00:00 +0000</pubDate><guid>https://www.netdata.cloud/blog/nvidia-dcgm-monitoring/</guid><description>&lt;p&gt;&lt;img src="../images/dcgm-collector.svg" alt="NVIDIA DCGM Collector: Deep GPU Monitoring for Data Center and AI Infrastructure"&gt;&lt;/p&gt;&#10;&lt;p&gt;GPU infrastructure is expensive and increasingly central to production workloads. Whether you&amp;rsquo;re running ML training jobs, inference serving, video transcoding, or HPC workloads, understanding what your GPUs are actually doing, and what&amp;rsquo;s going wrong when performance degrades, is not optional. The problem is that NVIDIA&amp;rsquo;s Data Center GPU Manager (DCGM) exposes an enormous amount of telemetry, but getting that data into a monitoring system in a useful, organized way has traditionally required significant setup and custom dashboarding work.&lt;/p&gt;</description></item><item><title>HPC Monitoring Software With Per-Second Metrics</title><link>https://www.netdata.cloud/solutions/use-cases/hpc/</link><pubDate>Thu, 18 Dec 2025 00:00:00 +0000</pubDate><guid>https://www.netdata.cloud/solutions/use-cases/hpc/</guid><description>Transform HPC operations with distributed edge-native monitoring that delivers sub-2-second insights, 90% cost reduction, and linear scalability to 100,000+ nodes - without the complexity.</description></item><item><title>LLM Monitoring Platform With Per-Second Visibility</title><link>https://www.netdata.cloud/solutions/use-cases/llm-monitoring/</link><pubDate>Thu, 18 Dec 2025 00:00:00 +0000</pubDate><guid>https://www.netdata.cloud/solutions/use-cases/llm-monitoring/</guid><description>Real-time infrastructure monitoring for LLM deployments. Track GPU utilization, container resources, database performance, and system metrics with per-second granularity and ML-powered anomaly detection.</description></item><item><title>Real-Time GPU Monitoring For AI Infrastructure</title><link>https://www.netdata.cloud/solutions/industries/ai/</link><pubDate>Thu, 18 Dec 2025 00:00:00 +0000</pubDate><guid>https://www.netdata.cloud/solutions/industries/ai/</guid><description>Monitor AI training clusters, inference APIs, and ML workloads with Netdata&amp;rsquo;s edge-native platform. Per-second visibility, ML-powered insights, predictable pricing.</description></item><item><title>Nvidia GPU Monitoring</title><link>https://www.netdata.cloud/monitoring-101/nvidia-monitoring/</link><pubDate>Mon, 01 Jan 0001 00:00:00 +0000</pubDate><guid>https://www.netdata.cloud/monitoring-101/nvidia-monitoring/</guid><description>&lt;h2 id="what-is-nvidia-gpu"&gt;What is Nvidia GPU?&lt;/h2&gt;&#10;&lt;p&gt;Nvidia GPU (Graphic Processing Unit) is a specialized electronic circuit designed to rapidly process and manipulate graphics data. Nvidia GPUs are typically found in high-end gaming computers, workstations, and servers. They are used to power complex video games and other graphics-intensive tasks.&lt;/p&gt;&#10;&lt;h2 id="monitoring-nvidia-gpu-with-netdata"&gt;Monitoring Nvidia GPU with Netdata&lt;/h2&gt;&#10;&lt;p&gt;The prerequisites for monitoring Nvidia GPU with Netdata are to have a system with an Nvidia GPU and &lt;a href="https://learn.netdata.cloud/docs/cloud/get-started/"&gt;Netdata installed&lt;/a&gt; on your system.&lt;/p&gt;</description></item><item><title>Nvidia GPU Monitoring</title><link>https://www.netdata.cloud/monitoring-101/nvidia_smi-monitoring/</link><pubDate>Mon, 01 Jan 0001 00:00:00 +0000</pubDate><guid>https://www.netdata.cloud/monitoring-101/nvidia_smi-monitoring/</guid><description>&lt;h2 id="nvidia-gpu-monitoring"&gt;Nvidia GPU Monitoring&lt;/h2&gt;&#10;&lt;h3 id="what-is-nvidia-gpu"&gt;What Is Nvidia GPU?&lt;/h3&gt;&#10;&lt;p&gt;Nvidia GPUs are specialized processing units designed by &lt;a href="https://www.nvidia.com/en-us/"&gt;Nvidia&lt;/a&gt; primarily for graphics rendering, though they are widely used in computational tasks such as deep learning, scientific simulations, and cryptocurrency mining. Nvidia&amp;rsquo;s advanced GPU technology empowers applications to perform complex tasks efficiently.&lt;/p&gt;&#10;&lt;h3 id="monitoring-nvidia-gpu-with-netdata"&gt;Monitoring Nvidia GPU With Netdata&lt;/h3&gt;&#10;&lt;p&gt;Netdata provides real-time monitoring for Nvidia GPUs by leveraging the &lt;code&gt;nvidia-smi&lt;/code&gt; CLI tool. This setup allows you to keep an eye on various performance metrics, ensuring optimal operation and helping diagnose potential issues as they occur.&lt;/p&gt;</description></item></channel></rss>