需用nvidia-smi、glxinfo、lshw、ps与journalctl组合分析:nvidia-smi查进程级显存占用,glxinfo验opengl显存线索,lshw核对硬件显存规格,ps结合/proc/pid/maps追溯gpu内存映射,journalctl检索驱动层显存初始化日志。

如果您在麒麟操作系统中需要精确掌握GPU显存(VRAM)当前被哪些进程占用、各占多少容量,而非仅显示总量使用率,则需借助终端命令与系统工具组合分析。以下是获取显存具体占用详情的多种方法:
一、使用nvidia-smi查看NVIDIA显卡显存分配详情
该命令专为NVIDIA GPU设计,可实时列出每个正在使用GPU的进程ID、用户、GPU索引、显存占用(MiB)、GPU利用率及运行命令,是定位显存占用源头最直接的方式。
1、打开终端,输入以下命令并回车:nvidia-smi -q -d MEMORY
2、在输出中查找“FB Memory Usage”段落,读取Total、Used、Free三项数值(单位为MiB)。
3、再次执行:nvidia-smi --query-compute-apps=pid,used_memory,process_name --format=csv
4、输出将按CSV格式显示每一行:进程PID、已用显存(如“1245 MiB”)、进程名称(如“python”或“Xorg”),可清晰识别显存大户。
5、若需持续监控,追加参数:watch -n 1 'nvidia-smi --query-compute-apps=pid,used_memory,process_name --format=csv'
二、通过glxinfo与grep提取OpenGL显存相关线索
对于未安装NVIDIA驱动或使用开源驱动(如nouveau、mesa)的场景,glxinfo虽不直接报告显存用量,但可通过渲染器信息推断GPU内存绑定状态,并结合系统内存映射辅助判断显存资源调用路径。
1、在终端中运行:glxinfo | grep "OpenGL renderer"
2、确认输出中是否包含“Gallium”、“llvmpipe”或具体GPU型号(如“AMD POLARIS10”),以排除纯CPU软渲染模式。
3、执行:glxinfo | grep "Video memory"
4、部分Mesa驱动版本会在输出中显示“Video memory: XXX MB”,该值为驱动识别的显存总量,可用于比对后续实际占用。
5、若需进一步追踪GPU内存映射,可结合:cat /sys/class/drm/card0/device/mem_info_vram_used(需存在对应sysfs节点且有读取权限)。
三、利用lshw命令获取GPU显存硬件规格与驱动绑定状态
lshw可读取设备固件级描述信息,包括显卡标称显存容量、总线宽度及当前加载驱动,虽不提供运行时占用快照,但能验证系统是否识别到全部显存硬件资源,为显存异常占用排查提供基准依据。
1、执行命令:sudo lshw -C display -short
2、在结果中定位“product”列旁的显卡型号,确认其官方标称显存(如“GeForce GTX 1650 4GB”中的4GB)。
3、再次运行:sudo lshw -C display
4、在详细输出中查找“size”字段(通常位于“memory”或“configuration”子节),其值为内核识别的显存大小(如“size: 4GiB”)。
5、检查“configuration”段中“driver”值是否为空或为“UNCLAIMED”,若为真,则显存无法被任何驱动管理,所有显存占用数据均不可信。
四、结合ps与/proc/PID/status反向追溯GPU相关进程显存申请
当nvidia-smi无输出或仅显示Xorg等基础进程时,可能存在非CUDA/OpenCL方式调用GPU内存的应用(如Vulkan程序、Wayland合成器)。此时需从进程内存映射入手,筛选出含GPU设备节点访问痕迹的进程。
1、列出所有打开/dev/nvidia*设备的进程:lsof /dev/nvidia*
2、对每个返回的PID,执行:cat /proc/[PID]/status | grep -i "vmrss\|vmsize"
3、重点观察VmRSS字段(物理内存驻留集),高值进程可能同步占用大量显存(尤其图形服务类进程)。
4、进一步检查其内存映射:cat /proc/[PID]/maps | grep -i "nvidia\|drm\|vgem"
5、若输出中出现大块rw-映射(如7f8a2c000000-7f8a6c000000 rw- 40000000),其长度(40000000十六进制≈1GB)即为该进程映射的显存区间估算值。
五、启用systemd-journald日志检索GPU驱动初始化与显存分配事件
内核在加载GPU驱动时会记录显存池初始化日志,包括显存起始地址、分配策略及初始保留量。这些信息虽非实时占用,但可确认驱动是否成功划分显存区域,避免因初始化失败导致显存统计失真。
1、执行:journalctl -k | grep -i "nvidia\|drm\|vgem" | grep -i "memory\|fb\|vram"
2、查找类似“NVRM: Reserving 256.0 MB of system memory for GPU framebuffer”的行,确认保留显存大小。
3、搜索“drm_kms_helper: fb0: drmfb frame buffer device”,确认帧缓冲区已注册。
4、若发现“Failed to allocate VRAM buffer”或“Out of VRAM”字样,说明驱动层显存分配已失败,上层工具显示的占用数据无效。
5、对Intel核显,补充执行:dmesg | grep -i "i915.*gt.*memory",提取GT内存管理器日志。










