讲师中心 微信公众号
AI工具推荐 视频效率加速

C++如何获取GPU显存的使用情况

梦瑶姑娘_3715

梦瑶姑娘_3715

发布时间:2026-07-15 16:53:20

|

319人浏览过

|

来源于php中文网

原创

Windows下用NVML获取NVIDIA GPU显存占用最可靠,需驱动≥410.48、管理员权限、调用nvmlInit_v2→GetHandle→GetMemoryInfo→Shutdown,used单位为字节;Linux可读/sys/class/drm/card*/device/mem_info_used_bytes或fallback至nvidia-smi命令解析。

c++如何获取gpu显存的使用情况

Windows下用NVML获取NVIDIA GPU显存占用

直接调用NVIDIA官方的NVML(NVIDIA Management Library)是最可靠的方式,前提是你的GPU是NVIDIA且驱动已安装完整。它不依赖CUDA运行时,也不要求程序本身用CUDA写,纯C接口,C++可直接链接使用。

常见错误现象:NVML_ERROR_LIBRARY_NOT_FOUND 或 NVML_ERROR_UNINITIALIZED,基本都是没把 nvidia-ml-py.dll(Windows)或 libnvidia-ml.so(Linux)放到PATH或运行目录,或者驱动版本太旧(需≥410.48)。

  • 下载CUDA Toolkit或单独安装NVIDIA驱动(含NVML),头文件在 C:\Program Files\NVIDIA GPU Computing Toolkit\CUDA\vX.X\include\nvml.h
  • 链接时加 -lnvidia-ml(Linux)或 nvidia-ml.lib(Windows,静态导入库在CUDA安装路径下)
  • 必须先调用 nvmlInit_v2(),结束前调用 nvmlShutdown(),否则后续所有API返回失败
  • 用 nvmlDeviceGetHandleByIndex(0, &device) 获取第0块卡,再用 nvmlDeviceGetMemoryInfo(device, &memInfo) 读取 memInfo.used 和 memInfo.total

Linux下通过/sys文件系统快速读取(无需SDK)

如果你只是想轻量级监控、不追求毫秒级精度,Linux可以直接读 /sys/devices/nvlink/device/ 下的伪文件,或者更通用的 /proc/driver/nvidia/gpus/*/information 和 /proc/driver/nvidia/gpus/*/hwmon/0/device/power —— 但显存用量实际藏在 /proc/driver/nvidia/gpus/*/information 并不暴露,真正可用的是 /proc/driver/nvidia/gpus/*/fb_mem(部分老驱动)或更稳定的 /sys/class/drm/card*/device/mem_info_*_bytes(仅限较新内核+DRM驱动)。

更通用稳妥的做法是读 /proc/driver/nvidia/gpus/*/information 确认设备存在后,走 /sys/class/drm/card*/device/gpu_busy_percent + mem_info_total_bytes + mem_info_used_bytes(如果存在)。但注意:这些节点不是所有内核版本都启用,尤其 mem_info_used_bytes 在主线内核5.15+才稳定支持。

立即学习“C++免费学习笔记(深入)”;

C++ Code Review Master
C++ Code Review Master

组合式C++代码评审方案,融合静态分析、AI推理、多轮迭代评审和C++专项检查,适用于PR审查、增量代码审查、全项目评审和代码质量评分,触发词包括review cpp、cpp代码评审、C++review、代码审查。

下载
  • 检查路径是否存在:ls /sys/class/drm/card*/device/mem_info_used_bytes
  • 读取示例:cat /sys/class/drm/card0/device/mem_info_used_bytes(单位字节)
  • 若该文件不存在,说明内核未导出或驱动未启用DRM管理,此时必须退回NVML或nvidia-smi
  • 权限问题常见:需root或加入 video 组,普通用户可能读不到

跨平台 fallback:调用nvidia-smi命令行解析输出

当NVML不可用、又不想硬依赖驱动内核模块时,最简单粗暴但有效的方法是执行 nvidia-smi --query-gpu=memory.used,memory.total --format=csv,noheader,nounits,然后解析stdout。适用于开发机、CI、脚本类场景,但不适合高频轮询(每次启动进程开销大,约20–50ms)。

容易踩的坑:nvidia-smi 默认输出带空格和单位(如 1234 MiB),--format=csv,noheader,nounits 才能拿到纯数字;另外Windows下要确保 nvidia-smi.exe 在PATH中,Linux下通常在 /usr/bin/nvidia-smi。

  • 推荐命令:nvidia-smi --query-gpu=memory.used,memory.total --format=csv,noheader,nounits
  • 输出样例:1234,8192(单位MiB)
  • C++中用 popen() 拿输出,注意截断换行符、跳过空行、处理超时(避免卡死)
  • 不要用 system(),无法捕获输出;也别漏掉错误码检查——nvidia-smi 返回非0时大概率是GPU不可用或权限不足

AMD GPU怎么办?ROCm没有等效NVML

目前没有官方、稳定、用户态免root的API能直接读AMD GPU显存用量。ROCm SDK(rocm-smi)功能接近nvidia-smi,但只支持Linux,且需安装完整ROCm栈(不只是驱动)。Windows下几乎无解,只能靠WMI查GPU温度/负载,显存用量无法获取。

rocm-smi --showmeminfo 可输出类似信息,但它底层依赖 /sys/class/kfd/kfd/topology/nodes/*/mem_banks/*/properties,权限要求高,且不同ROCm版本字段名可能变动(比如 used_memory vs mem_used)。

  • 确认ROCm安装:运行 rocm-smi --version,失败则无法继续
  • 命令建议:rocm-smi --showmeminfo --csv --no-header(输出格式较稳定)
  • 注意:ROCm 5.6+ 才支持 --showmeminfo,旧版只能看总显存,不能看已用
  • 不建议自己读 /sys 节点——AMD的sysfs结构比NVIDIA更不稳定,同一驱动版本在不同内核上节点名可能不同
实际用的时候,优先走NVML;部署环境不确定驱动状态就fallback到nvidia-smi;AMD用户得接受“Linux+ROCm”这个前提,其他情况基本只能放弃显存监控。显存用量本身不是原子指标,NVML读出来也是快照,别指望它实时反映kernel launch瞬间的峰值。

热门AI工具

更多
LibLibAI
LibLibAI Hot

一款AI视频创作工具,主要用于国内领先的AI创意平台,以海量模型、低门槛操作与“创作-分享-商业化”生态,让小白与专业创作者都能高效实现图文乃至视频创意表达,适合需要提升相关任务效率的用户。

PixTV
PixTV Hot

PixTV是一款面向AIGC内容创作的AI视频生成工具。

火山引擎

火山引擎是一款面向企业的云计算与AI服务平台。

UP简历
UP简历 Hot

一款AI办公效率工具,主要用于基于AI技术的免费在线简历制作工具,适合需要提升相关任务效率的用户。

DeepSeek

DeepSeek是一款面向对话、写作、编程和推理场景的AI大模型工具。

讯飞绘文

讯飞绘文是一款由科大讯飞推出的一站式 AIGC 内容运营平台。

WorkBuddy

一款AI办公效率工具,主要用于腾讯云推出的AI原生桌面智能体工作台,适合需要提升相关任务效率的用户。

豆包大模型

豆包大模型是一款由字节跳动推出的企业级大语言模型服务平台。

咔片AIPPT

一款在线AI演示文稿制作工具,可根据主题和内容需求辅助生成PPT结构与页面,提高演示材料制作效率。

相关专题

更多
c++和c语言的区别有哪些
c++和c语言的区别有哪些

c++和c语言的区别:1、面向对象编程(OOP)支持不同;2、新增特性不同;3、标准库不同;4、编译方式不同;5、命名空间不同等等。想了解更多c++的相关内容,可以阅读本专题下面的文章。

2208

2024.03.14

c++和python学习顺序推荐
c++和python学习顺序推荐

一般建议先学习C++,再学习Python,因为这样可以逐步从较为底层的编程语言向更高级的语言过渡。想了解更多python的相关内容,可以阅读本专题下面的文章。

979

2024.03.14

python和c++学习性价比分析
python和c++学习性价比分析

Python易于学习,广泛应用于Web开发、数据科学和人工智能等领域,但性能较低。C语言性能高,适用于对性能要求较高的场景,如游戏开发和系统编程,但学习曲线陡峭,错误处理复杂。想了解更多python的相关内容,可以阅读本专题下面的文章。

407

2024.03.14

c语言和c++一样吗
c语言和c++一样吗

c语言和c++是两种不同的编程语言,虽然有相似之处,但存在显著差异。c语言专注于过程式编程和系统级开发,以简洁、高效著称。c++作为c语言的超集,引入了面向对象编程,增强了代码组织和管理能力,但学习曲线也更陡峭。本专题为大家提供相关的文章、下载、课程内容,供大家免费下载体验。

307

2024.03.14

c语言和c++先学哪个好
c语言和c++先学哪个好

初学者选择学习c语言还是c++语言,需要根据个人学习目标、背景以及编程兴趣和预期应用方向来决定。本专题为大家提供相关的文章、下载、课程内容,供大家免费下载体验。

386

2024.03.14

c语言和c++的区别和联系
c语言和c++的区别和联系

c语言和c++是计算机科学领域应用广泛的编程语言。虽然它们有着相似的基础,但它们在语言类型、语法功能和内存管理方面存在着显著差异。本专题为大家提供相关的文章、下载、课程内容,供大家免费下载体验。

580

2024.03.14

c++软件中文更改教程
c++软件中文更改教程

对于 ide,可通过打开设置,找到语言设置,选择中文,并保存更改。对于非 ide 应用程序,可查找设置或选项,选择语言设置,更改为中文,并保存更改。想了解更多c++的相关内容,可以阅读本专题下面的文章。

1389

2024.03.21

python和java和c++学习性价比分析
python和java和c++学习性价比分析

Python以其易学性、丰富的库和活跃的社区而著称,适合数据科学、人工智能和Web开发。Java以其跨平台性、企业级应用开发和Android应用开发而闻名。C++以其底层控制能力、高效性能和游戏开发而著称。选择哪种语言取决于个人兴趣、职业方向和特定需求。想了解更多python和java和c++的相关内容,可以阅读本专题下面的文章。

1197

2024.03.22

LLVM自定义Pass怎么写
LLVM自定义Pass怎么写

本专题聚焦LLVM自定义Pass开发,整理Pass类结构、run()方法、PreservedAnalyses、CMake构建、插件注册、-load-pass-plugin加载和测试用例编写流程。

80

2026.09.30

热门下载

更多
网站特效
/
网站源码
/
网站素材
/
前端模板

精品课程

更多
相关推荐
/
热门推荐
/
最新课程
Conan 2 Essentials 免费课程
Conan 2 Essentials 免费课程

共0课时 | 0人学习

CMake 与 Conan 集成实践
CMake 与 Conan 集成实践

共0课时 | 0人学习

Conan 2 高级依赖模型介绍
Conan 2 高级依赖模型介绍

共0课时 | 0人学习

关于我们 免责申明 举报中心 意见反馈 讲师合作 广告合作 最新更新
php中文网:公益在线php培训,帮助PHP学习者快速成长!
关注服务号
PHP中文网订阅号
每天精选资源文章推送

Copyright 2014-2026 https://www.php.cn/ All Rights Reserved | php.cn