lscpu --extended=cpu,socket,core,node可清晰显示每逻辑核归属的物理插槽、核心及numa节点,避免仅看核总数导致绑核性能下降;node为空或为-需检查bios numa设置或内核参数。

直接看 lshw -short 就能快速列出所有物理设备层级,但真正要厘清“CPU怎么连内存、PCIe设备挂在哪条链路上、磁盘属于哪个控制器”,必须分层查,不能只靠一个命令。
用 lscpu --extended 看 CPU 与 NUMA 节点的物理映射
这是最易被跳过的一步——很多人只跑 lscpu 看个总数,结果绑核后性能反而掉。关键不是有多少核,而是每个逻辑 CPU(CPU 列)归属哪个插槽(SOCKET)、核心(CORE)、NUMA 节点(NODE)。
-
lscpu --extended=CPU,SOCKET,CORE,NODE输出紧凑,一行一核,避免/proc/cpuinfo里手动比对physical id和core id的错误 - 若某行
NODE为空或为-,说明内核没识别到 NUMA 拓扑,得检查 BIOS 是否关闭 NUMA 或启动参数含numa=off - 超线程启用时,同一
SOCKET+CORE会重复出现多次(如 CPU 0 和 CPU 1),这不是错误,是正常现象 - 虚拟机里该输出可能失真:若
lscpu | grep Hypervisor非空,NODE和SOCKET值仅反映 Hypervisor 暴露的逻辑结构,不是宿主机真实布局
用 numactl --hardware 确认 NUMA 内存拓扑是否生效
numactl --hardware 不是运行时快照,它读的是内核初始化时探测到的硬件拓扑,所以比 /sys/devices/system/node/ 下的实时文件更稳定,适合诊断“为什么进程总从远端节点分配内存”。
Linux系统管理专家,覆盖12大模块:用户权限、SSH、存储、网络、systemd、防火墙、日志监控、备份恢复、TLS证书、Ansible、容器、IaC。提供配置、验证、加固、监控、备份、自动化、故障排查、回滚闭环。关键词:useradd、sudo、sshd_config、chmod、SEL...
- 重点看
available: N nodes和node X size:—— 若显示 2 个节点但node 1 size:为 0,说明 BIOS 禁用了 NUMA,或内存插槽未对称安装 -
node distances:表中非对角线数值若 ≥25,跨节点访问开销已显著;此时硬绑numactl --cpunodebind=0 --membind=1反而拖慢 - 某些主板开启 SNC(Sub-NUMA Clustering)后,
numactl --hardware会显示 4 个节点,但实际只有 2 个内存控制器——需结合dmesg | grep -i numa确认内核是否接受该模式 - 它不显示 PCIe 设备归属,也不反映当前进程内存页位置,纯硬件视角,别拿它判断“某个进程用了哪块内存”
用 lspci -t 和 lsblk -o NAME,PKNAME,TYPE 对齐 I/O 物理路径
CPU、内存、I/O 是三套独立拓扑,混在一起看容易误判瓶颈。比如 NVMe 盘延迟高,未必是盘本身问题,可能是它挂在了远离 CPU 的 PCIe Root Port 上。
-
lspci -t输出缩进树,根节点是 CPU 或 PCH,往下每级缩进代表一次桥接(Bridge);若某 GPU 或 NVMe 设备缩进很深,说明路径长、潜在带宽受限 -
lsblk -o NAME,PKNAME,TYPE中PKNAME显示父设备名(如nvme0n1p1的PKNAME是nvme0n1),能确认 LVM/RAID 加密层是否引入额外跳转 - 物理盘定位靠
lsblk -S:输出SERIAL和MODEL,再配合 RAID 工具(如MegaCli64 -AdpAllInfo)里的Slot Number才能真正把/dev/sdb对应到机箱第 3 槽位那块硬盘 -
lsblk默认不显示传输协议,若需区分 SATA/NVMe/SAS,加-d -o NAME,TRAN,MODEL,SERIAL
用 lshw -class memory 和 lshw -class bus 查内存插槽与总线连接关系
lshw 是唯一能告诉你“哪根内存条插在哪个通道、哪条 DIMM 插槽”的工具,但它必须 root 权限才完整——没权限时 size 和 serial 字段会缺失,导致无法判断双通道是否生效。
-
sudo lshw -class memory输出中,每个memory节点下的description含 “DIMM”、“Channel”、“Bank” 等关键词,slot字段对应主板丝印编号(如A1,B2) -
sudo lshw -class bus显示 PCI/PCIe 总线层级,能看出 USB 控制器、网卡是否直连 CPU 还是经由 PCH,这对低延迟场景(如 DPDK)至关重要 - 若
lshw报 “not accessible” 或字段为空,先确认是否以 root 运行;部分 ARM 平台或老旧 BIOS 可能不支持 DMI 表导出,此时只能查/sys/firmware/devicetree/或厂商文档 -
lshw -html > hw.html生成的报告可直接浏览器打开,比终端滚动更易发现拓扑异常(比如某块 GPU 出现在两个不同 PCIe 域下)
真正难的不是命令怎么敲,而是当 lscpu --extended 显示 CPU 0~7 属于 node 0,而 numactl --hardware 显示 node 0 内存只剩 2GB,但 /sys/devices/system/node/node0/meminfo 里 MemFree 却有 32GB——这时候得怀疑内核是否启用了 hugepages 或 cgroup 限制,而不是继续翻拓扑命令。










