在银河麒麟v10中定位进程卡死需用pstack或gdb获取实时调用栈:pstack pid可快速查看主线程堆栈,缺失时需安装binutils;gdb -p pid配合thread apply all bt可获取全量线程栈,d状态则应排查i/o或锁竞争。

在银河麒麟V10系统中排查进程卡死、死循环或信号阻塞时,需实时获取其当前函数调用链,否则仅看ps或top无法定位到具体哪一行代码陷入异常。查看运行堆栈必须依赖gdb或pstack等调试工具对正在运行的进程做轻量级快照,不可直接读取内存或假设线程状态。
使用pstack快速抓取主线程堆栈
这一步操作起来很简单,直接在终端执行即可,适用于大多数用户态进程(非内核线程、非ptrace受限进程)。
执行:pstack <strong>【PID】</strong>,其中【PID】为你要分析的进程号,例如pstack 12345。
若提示command not found,说明未安装debuginfo包,需先运行:sudo apt install pstack(银河麒麟V10默认源中该命令属于binutils套件,部分精简镜像需手动安装)。
输出内容以“Thread N (LWP M)”开头,第一组即为主线程;每行显示函数名+偏移地址+源码位置(若有调试符号),无符号时会显示“??”。
用gdb附加进程并打印完整线程堆栈
当pstack输出不全、线程挂起在系统调用中,或需查看寄存器/局部变量时,必须用gdb深入调试。此方法要求目标进程未被其他调试器占用,且用户对目标进程有读写权限。
方法一:启动gdb并附加
执行:gdb -p <strong>【PID】</strong>,等待gdb加载符号表并停在当前执行点。
输入:thread apply all bt,一次性打印所有线程的完整回溯,包括阻塞在futex_wait、epoll_wait等系统调用中的线程。
输入:detach→quit安全退出,不中断进程运行。
方法二:免交互式一键导出(推荐用于脚本化采集)
执行:gdb -p <strong>【PID】</strong> -ex "thread apply all bt" -ex "detach" -ex "quit" 2>/dev/null | grep -E "^(#|Thread)",过滤掉冗余提示,只保留堆栈关键行。
注意:若进程处于D(uninterruptible sleep)状态,gdb可能无法附加,此时应优先检查I/O或锁竞争,而非强行调试。
针对无调试符号的生产环境进程查堆栈
工业版或服务器版常裁剪debuginfo,导致gdb/pstack仅显示地址无函数名。此时需结合addr2line和/proc/PID/maps还原逻辑路径。
第一步:提取堆栈地址行
运行pstack <strong>【PID】</strong> | grep "^#" | awk '{print $3}' | sed 's/0x//' | head -n 10,获取前10个十六进制地址(去掉0x前缀)。
第二步:定位对应映射文件
执行:awk '$6 ~ /r-xp/ {print $1, $6}' /proc/<strong>【PID】</strong>/maps,找出含可执行权限的内存段及其起始地址,匹配上步地址落在哪个段内。
第三步:用addr2line反查(需有原始二进制文件)
例如某地址1a2b3c落在/usr/bin/myapp的0000000000010000-0000000000050000段,则真实偏移为1a2b3c - 10000 = 192b3c,再执行:addr2line -e /usr/bin/myapp 0000000000192b3c。











