麒麟系统需用perf工具通过pmu获取cpu底层周期统计:先检查perf_event_paranoid值并设为-1,再用perf stat测cpi,perf record结合debuginfo和火焰图定位高耗时指令。

如果您在麒麟操作系统中需要获取CPU执行指令的底层周期统计信息,例如每条指令平均耗时(CPI)、缓存未命中导致的周期延迟、分支预测失败引发的流水线停顿等,这类数据无法通过常规系统命令直接读取,必须依赖硬件性能计数器(Performance Monitoring Unit, PMU)并启用内核支持的perf工具进行采样。
确认系统是否支持perf及PMU功能
perf是Linux内核自带的性能分析接口,但部分麒麟OS镜像可能默认禁用或未编译PMU驱动模块。
打开终端,执行:cat /proc/sys/kernel/perf_event_paranoid。
若返回值为【-1】,表示perf可无限制访问硬件计数器;若为2或更高,则普通用户无法采集底层周期事件,需先执行sudo sysctl -w kernel.perf_event_paranoid=-1临时放行。
运行perf list | grep -i cycle,确认输出中包含cycles、instructions、cache-misses等关键事件名——缺失即说明当前CPU微架构不被perf识别或内核未启用对应驱动。
使用perf stat统计指定进程的指令周期比(CPI)
CPI(Cycles Per Instruction)是衡量CPU指令执行效率的核心指标,数值越低说明流水线越高效。
方法一:对单个命令实时采样
执行:perf stat -e cycles,instructions,cache-misses,branch-misses --timeout 5000 sleep 1。
该命令强制perf在5秒内采集sleep进程的硬件事件,其中cycles与instructions的比值即为CPI——perf会在输出末尾自动计算并显示seconds time elapsed和instructions per cycle(IPC),IPC倒数即CPI。
方法二:附加到已运行进程(需PID)
先用ps aux | grep your_process_name查出目标进程PID,再执行:sudo perf stat -e cycles,instructions -p PID -I 1000。
本文档主要讲述的是Android 操作系统的介绍;Android是基于Linux内核的操作系统,是Google公司在2007年11月5日公布的手机操作系统,早期由Google开发,后由开放手持设备联盟(Open Handset Alliance)开发。它采用了软件堆层(software stack,又名以软件叠层)的架构,主要分为三部分。底层Linux内核只提供基本功能;其他的应用软件则由各公司自行开发,部分程序以Java编写。希望本文档会给有需要的朋友带来帮助;感兴趣的朋友可以过来看看
-I 1000表示每秒输出一次瞬时CPI快照,持续至进程结束;注意必须用sudo,否则无法attach到其他用户进程。
采集细粒度指令级周期分布(需debuginfo支持)
若要定位具体哪条指令消耗最多周期(如某次访存卡顿、某次分支跳转失败),需符号化反汇编,这要求目标程序已安装debuginfo包且编译时带-g。
第一步:安装debuginfo(以glibc为例)
执行:sudo apt install glibc-debuginfo(Kylin V10 Desktop)或sudo yum debuginfo-install glibc(Server版)。
第二步:录制带调用栈的周期事件
运行:sudo perf record -e cycles,instructions --call-graph dwarf -g -a sleep 3。
--call-graph dwarf启用DWARF调试信息解析调用链,-a表示全系统采样,sleep 3作为触发窗口——实际应用中应替换为待分析的程序路径及参数。
第三步:生成火焰图式周期热点报告
执行:sudo perf script | stackcollapse-perf.pl | flamegraph.pl > cpi_flame.svg。
该命令将原始采样数据转换为交互式SVG火焰图,宽度代表周期占比,纵向堆叠反映调用深度,最宽底部函数即为CPI贡献最大者。










