Windows下最可靠方式是通过DXGI的QueryVideoMemoryInfo获取GPU显存已提交量和建议上限,需过滤软件适配器、初始化COM并链接dxgi.lib;Linux则依赖sysfs或nvidia-smi/NVML,跨平台无统一API。

Windows平台用 DXGI 枚举适配器获取显存使用量
Windows 下最可靠的方式是通过 DirectX Graphics Infrastructure(DXGI)查询 GPU 显存占用,尤其适用于独显(NVIDIA/AMD),集成显卡支持度较差但也能拿到部分信息。关键不是“当前显存占用”,而是“GPU 内存已提交量”(UsedVideoMemory)和“总可用显存”(AvailableVideoMemory),它们来自 IDXGIAdapter3::QueryVideoMemoryInfo。
常见错误是直接调用 GetVideoMemoryInfo(旧版未公开函数)或误用 WMI(返回值常为 0 或不更新)。必须使用 DXGI_ADAPTER_FLAG_SOFTWARE 过滤掉软件渲染器,并确保使用 DXGI_ADAPTER_FLAG_NONE 获取物理 GPU。
- 需链接
dxgi.lib,头文件包含<dxgi.h>和<d3d11.h>(即使不创建 D3D 设备) - 调用前必须初始化 COM:用
CoInitializeEx(nullptr, COINIT_APARTMENTTHREADED) -
QueryVideoMemoryInfo返回的DXGI_QUERY_VIDEO_MEMORY_INFO中,CurrentUsage是当前已用显存(字节),Budget是系统建议上限(非总显存) - NVIDIA 驱动通常返回准确值;AMD 在较新驱动(Adrenalin 22.5.1+)才稳定支持;Intel 核显多数返回 0 或恒定值
Linux 上通过 /sys/class/drm 或 nvidia-smi 获取显存
Linux 没有统一 API,方案取决于 GPU 类型和驱动。开源驱动(如 amdgpu、i915)暴露 sysfs 接口;闭源驱动(nvidia)依赖用户态工具或 NVML。
直接读 /sys/class/drm/card*/device/mem_info_vram_used 和 mem_info_vram_total 最轻量,但仅限 AMD 和 Intel(部分型号)。NVIDIA 必须走 nvidia-smi --query-gpu=memory.used,memory.total --format=csv,noheader,nounits 或集成 libnvidia-ml.so(NVML)。
组合式C++代码评审方案,融合静态分析、AI推理、多轮迭代评审和C++专项检查,适用于PR审查、增量代码审查、全项目评审和代码质量评分,触发词包括review cpp、cpp代码评审、C++review、代码审查。
立即学习“C++免费学习笔记(深入)”;
- 注意路径可能不存在(如无 card0)、权限不足(需 root 或 video 组)、或值为 -1(驱动未启用显存统计)
-
nvidia-smi是进程级调用,开销较大;频繁轮询建议改用 NVML 的nvmlDeviceGetMemoryInfo - Intel 核显在
i915驱动下,/sys/class/drm/renderD128/device/gt/gt_cur_freq_mhz等路径不反映显存,别混淆
跨平台封装要注意的陷阱
没有标准 C++ API 能跨 Windows/Linux 获取显存,强行抽象容易掩盖底层差异。比如把 “显存占用率” 定义为 (used / total) * 100,但在 Windows 上 Budget 可能小于 EvictionPolicy 总量,Linux 上 mem_info_vram_total 可能包含预留内存,导致百分比虚高。
- 不要缓存首次查询结果后长期复用——显存占用每秒波动剧烈,尤其游戏或训练场景
- 避免在主线程阻塞调用
nvidia-smi或QueryVideoMemoryInfo(后者在多适配器时可能耗时 10–20ms) - Windows 上若
EnumAdapters1返回 S_FALSE 表示无兼容 DXGI 适配器,此时应降级尝试 WMI(Win32_VideoController)或忽略,而非报错退出 - Linux 下不同发行版的 sysfs 路径命名不一致(如
card0vsrenderD128),需遍历/sys/class/drm/目录并过滤含device子目录的项
C++ 示例:Windows 下最小可行查询逻辑
IDXGIFactory4* factory = nullptr;
CreateDXGIFactory1(__uuidof(IDXGIFactory4), (void**)&factory);
IDXGIAdapter3* adapter = nullptr;
// Enumerate first physical GPU
if (SUCCEEDED(factory->EnumAdapters1(0, &adapter))) {
DXGI_QUERY_VIDEO_MEMORY_INFO info = {};
adapter->QueryVideoMemoryInfo(0, DXGI_MEMORY_SEGMENT_GROUP_LOCAL, &info);
printf("Used: %llu MB, Budget: %llu MB\n",
info.CurrentUsage / 1024 / 1024,
info.Budget / 1024 / 1024);
}
if (adapter) adapter->Release();
if (factory) factory->Release();
这段代码只查第一个适配器,且忽略错误码检查(实际必须判断 SUCCEEDED 和 info.CurrentUsage > 0)。更健壮的做法是循环所有适配器、跳过 DXGI_ADAPTER_FLAG_SOFTWARE、对 CurrentUsage == 0 的情况打日志而不是直接使用。
真正难的不是调用哪个函数,而是判断返回值是否可信——显存监控天然存在采样延迟、驱动实现差异和权限边界,拿到数字后还得结合上下文验证合理性。

















