需先用lspci识别GPU类型,再依NVIDIA、AMD或景嘉微分别执行nvidia-smi、radeontop或读取/proc/gpuinfo_0获取实时负载;驱动未就绪则所有监控命令失效。

您需要在统信UOS终端中实时掌握GPU当前的计算负载、显存带宽占用或核心忙闲周期,以便判断渲染卡顿、训练停滞或视频解码缓慢是否由显卡过载导致。不同厂商GPU必须使用专用工具,混用命令将无法返回有效数据。
确认显卡类型与驱动就绪状态
打开终端(Ctrl + Alt + T),执行:
lspci | grep -i vga
观察输出中的关键词:含“NVIDIA”且无“nouveau”字样、含“AMD”或“Advanced Micro Devices”、含“JingJia”“JM”或“Moore Threads”则分别对应三类GPU。这一步不可跳过,因为后续所有命令都依赖此判断。
紧接着验证驱动是否真正加载:
· NVIDIA:运行 lsmod | grep nvidia,有非空输出才可继续;
· AMD:运行 lsmod | grep amdgpu,若为空需先启用开源驱动;
· 景嘉微:运行 ls /proc/gpuinfo_0,文件存在即接口可用。【若任一检查失败,后续监控命令将报错或返回0%】
NVIDIA GPU:用nvidia-smi查看核心与显存负荷
该命令仅在NVIDIA专有驱动启用后生效,直接读取GPU内部PMU寄存器,数值延迟低于100ms。
执行:
nvidia-smi -l 1
界面每秒刷新一次,重点关注三列:
“GPU-Util”为流处理器实际使用率(非占用时间百分比,而是SM活跃周期占比);
“Memory-Usage”显示显存已分配量,但不反映带宽压力;
“Volatile GPU-Util”下方若出现“P0”功耗状态,说明GPU处于高性能调度模式。
注意:若“GPU-Util”长期为0%,但进程列表中有CUDA任务,可能是应用未正确绑定GPU设备,需检查CUDA_VISIBLE_DEVICES环境变量。
AMD GPU:用radeontop监控引擎级负荷
radeontop能穿透amdgpu驱动暴露GPU各子单元实时负载,包括图形引擎、视频编解码器和显存控制器,比glxinfo更贴近硬件真实压力。
方法一:安装并运行
sudo apt install radeontop → sudo radeontop
方法二:若系统已预装,直接运行 sudo radeontop 即可进入交互界面。
主界面中,“% GPU”行代表3D引擎整体利用率;“% VRAM”是显存控制器带宽占用率,超过85%常伴随帧率抖动;“% VCE/UVD”分别对应H.264/H.265编码与解码单元,播放4K视频时此处应明显跳动。
退出按 q 键。该工具需root权限访问PCIe配置空间,普通用户执行会提示“Permission denied”。
景嘉微GPU:读取/proc/gpuinfo_0获取整数型负荷值
景嘉微JM系列在UOS下不提供类nvidia-smi的交互式工具,其负荷以静态快照形式暴露在procfs中,适用于脚本轮询或日志归档。
第一步:确认接口可用
ls /proc/gpuinfo_0
第二步:提取负荷字段
cat /proc/gpuinfo_0 | grep -E "(gpu_util|core_load|usage)"
输出类似 “gpu_util: 67” 或 “core_load: 32”,数值为0–100之间的整数,代表最近1秒内核心调度器统计的忙时占比。该值不区分3D/计算/视频负载,是整体粗粒度指标。
若grep无输出,说明当前驱动版本未导出负荷字段,需升级至UOS 20.5+配套的jm-gpu-driver 2.3.1及以上版本。


















