转载:火焰图(Flame Graphs)的安装和基本用法

火焰图(Flame Graphs)的安装和基本用法

火焰图(Flame Graphs)

一、概述:

火焰图(flame graph)是性能分析的利器,通过它可以快速定位性能瓶颈点。

perf 命令(performance 的缩写)是 Linux 系统原生提供的性能分析工具,会返回 CPU 正在执行的函数名以及调用栈(stack)。

本文介绍它的安装和基本用法。

二、安装perf和可视化生成器

# yum install perf -y           //yum方式安装perf

# git clone https://github.com/brendangregg/FlameGraph.git               //选择好火焰图文件存放路径后执行该条命令,从github上获取火焰图的相关文件,获取完成后会有一个FlameGraph的文件夹,如下图

说明:打开文件夹,里面大部分是perf语言写的脚本,生成火焰图后续会用到,如下图,右图为各pl文件用途释义

到此,安装完成。

三、perf 采集数据

# perf record -F 99 -a -g -- sleep 60               //对CPU所有进程以99Hz采集,它的执行频率是 99Hz(每秒99次),如果99次都返回同一个函数名,那就说明 CPU 这一秒钟都在执行同一个函数,可能存在性能问题。执行60秒后会弹出如下图提示表示采集完成,在当前目录会生成一个perf.data的文件

# perf record -F 99 -p 181 -g -- sleep 60        //对进程ID为181的进程进行采集,采集时间为60秒,执行期间不要退出上述代码中perf record表示记录,-F 99表示每秒99次,-p 13204是进程号,即对哪个进程进行分析,-g表示记录调用栈,sleep 30则是持续30秒,-a 表示记录所有cpu调用。更多参数可以执行perf --help查看。
perf.data文件生成后,表示采集完成。最好是在火焰图的目录下进行采集,方便转换成SVG图形。

四、生成火焰图

perf script -i perf.data &> perf.unfold                        //生成脚本文件./FlameGraph/stackcollapse-perf.pl perf.unfold &> perf.folded              ./FlameGraph/flamegraph.pl perf.folded > perf.svg                       

说明:如果是Linux开发板上做性能分析,则涉及到perf的操作放在开发板上完成,如下两条操作所示:

perf record -F 99 -p 181 -g -- sleep 60perf script -i perf.data &> perf.unfold  

而FlameGraph相关操作在ubuntu系统内完成。

//执行完成后生成perf.svg图片,用浏览器打开 perf.svg,如下图

五、火焰图的含义

火焰图是基于 perf 结果产生的 SVG 图片,用来展示 CPU 的调用栈。

y 轴表示调用栈,每一层都是一个函数。调用栈越深,火焰就越高,顶部就是正在执行的函数,下方都是它的父函数。

x 轴表示抽样数,如果一个函数在 x 轴占据的宽度越宽,就表示它被抽到的次数多,即执行的时间长。注意,x 轴不代表时间,而是所有的调用栈合并后,按字母顺序排列的。

火焰图就是看顶层的哪个函数占据的宽度最大。只要有"平顶"(plateaus),就表示该函数可能存在性能问题。

颜色没有特殊含义,因为火焰图表示的是 CPU 的繁忙程度,所以一般选择暖色调。

六、互动性

火焰图是 SVG 图片,可以与用户互动。

(1)鼠标悬浮

火焰的每一层都会标注函数名,鼠标悬浮时会显示完整的函数名、抽样抽中的次数、占据总抽样次数的百分比。下面是一个例子。


mysqld'JOIN::exec (272,959 samples, 78.34 percent)

(2)点击放大

在某一层点击,火焰图会水平放大,该层会占据所有宽度,显示详细信息。

左上角会同时显示"Reset Zoom",点击该链接,图片就会恢复原样。

(3)搜索

按下 Ctrl + F 会显示一个搜索框,用户可以输入关键词或正则表达式,所有符合条件的函数名会高亮显示。

七、火焰图示例

下面是一个简化的火焰图例子。

首先,CPU 抽样得到了三个调用栈。


func_c
func_b
func_a
start_thread func_d
func_a
start_thread func_d
func_a
start_thread

上面代码中,start_thread是启动线程,调用了func_a。后者又调用了func_bfunc_d,而func_b又调用了func_c

经过合并处理后,得到了下面的结果,即存在两个调用栈,第一个调用栈抽中1次,第二个抽中2次。


start_thread;func_a;func_b;func_c 1
start_thread;func_a;func_d 2

有了这个调用栈统计,火焰图工具就能生成 SVG 图片。

上面图片中,最顶层的函数g()占用 CPU 时间最多。d()的宽度最大,但是它直接耗用 CPU 的部分很少。b()c()没有直接消耗 CPU。因此,如果要调查性能问题,首先应该调查g(),其次是i()

另外,从图中可知a()有两个分支b()h(),这表明a()里面可能有一个条件语句,而b()分支消耗的 CPU 大大高于h()

八、局限

两种情况下,无法画出火焰图,需要修正系统行为。

(1)调用栈不完整

当调用栈过深时,某些系统只返回前面的一部分(比如前10层)。

(2)函数名缺失

有些函数没有名字,编译器只用内存地址来表示(比如匿名函数)。

详细的操作可以看这篇文章。

参考资料:

https://github.com/brendangregg/FlameGraph

http://www.brendangregg.com/flamegraphs.html

https://www.jianshu.com/p/492218c163d9

http://www.ruanyifeng.com/blog/2017/09/flame-graph.html

【Linux性能分析】火焰图(Flame Graphs)的安装和基本用法相关推荐

  1. 实时观测程序运行状态——火焰图(Flame Graphs)

    转载:(69条消息) 火焰图(Flame Graphs)的安装和基本用法_san.hang的博客-CSDN博客 火焰图(Flame Graphs) 一.概述: 火焰图(flame graph)是性能分 ...

  2. Linux下用火焰图进行性能分析

    1 火焰图简介 很多人感冒发烧的时候, 往往会模仿神农氏尝百草的路子: 先尝尝抗病毒的药, 再试试抗细菌的药, 甭管家里有什么药挨个试, 什么中药西药, 瞎猫总会碰上死耗子, 如此做法自然是不可取的, ...

  3. Linux性能分析命令工具汇总

    转自:http://rdc.hundsun.com/portal/article/731.html?ref=myread 出于对Linux操作系统的兴趣,以及对底层知识的强烈欲望,因此整理了这篇文章. ...

  4. linux性能监控工具perf,Linux性能分析中常用的工具perf介绍

    今天小编要跟大家分享的文章是关于Linux性能分析中常用的工具perf介绍.系统级性能优化通常包括两个阶段:性能剖析(performance profiling)和代码优化.性能剖析的目标是寻找性能瓶 ...

  5. (转)超全整理!Linux性能分析工具汇总合集

    原文地址:https://rdc.hundsun.com/portal/article/731.html?ref=myread 出于对Linux操作系统的兴趣,以及对底层知识的强烈欲望,因此整理了这篇 ...

  6. Linux 性能分析工具汇总

    Linux 性能分析工具汇总 我从cnaaa.com购买了服务器. 出于对Linux操作系统的兴趣,以及对底层知识的强烈欲望,因此整理了这篇文章.本文也可以作为检验基础知识的指标,另外文章涵盖了一个系 ...

  7. Linux性能分析工具详解

    Linux性能分析工具详解 一.tcpdump 常用用法: 这里用sudo因为当前帐号无权使用tcpdump,这里仅以一个tcp的例子来说明:sudo /usr/sbin/tcpdump tcp po ...

  8. 【转】一文掌握 Linux 性能分析之网络篇(续)

    [转]一文掌握 Linux 性能分析之网络篇(续) 在上篇网络篇中,我们已经介绍了几个 Linux 网络方向的性能分析工具,本文再补充几个.总结下来,余下的工具包括但不限于以下几个: sar:统计信息 ...

  9. Linux 性能分析的前 60 秒

    Linux 性能分析的前 60 秒 为了解决性能问题,你登入了一台 Linux 服务器,在最开始的一分钟内需要查看什么? 在 Netflix 我们有一个庞大的 EC2 Linux 集群,还有非常多的性 ...

  10. Linux性能分析和调整的基本原则

    Linux性能分析和调整的基本原则 优化linux系统需要考虑多方面的因素,因为各个因素之间相互关联,因此遇到性能问题以及性能的调节需要综合考虑,基本要素考虑与分析:   1,那些措施能确实×××能? ...

最新文章

  1. 同一份数据,Redis为什么要存两次?
  2. 学废了!提高工作效率的五个步骤! | 每日趣闻
  3. 穿过代理服务器取远程用户真实IP地址
  4. linux中查询动态库版本的命令,linux 程序、动态库、静态库内部添加版本号和编译时间详解...
  5. 深度学习(十四)——Softmax详解, 目标检测, RCNN
  6. 前端学习(2533):mapgetter和actions
  7. java url headers,Java CloseableHttpResponse.getHeaders方法代码示例
  8. py导入包异常跳出_马克的Python学习笔记#模块和包
  9. 如何使用WordPress美化网站
  10. Ignite 的使用过程(一)
  11. python str.split以及str.split字符串分割函数
  12. 工业级路由器和家用路由器的区别_工业级路由器和家用路由器有何区别?
  13. 基于OpenSSL,实现SM2签名数据的ASN1编码转换
  14. 牛客网练习—《网络基础》DAY2
  15. python求上α分位点_什么是标准正态分布的上α分位点以及怎样求?
  16. 阿语谈流量之自媒体大鱼号讲解1.1.4
  17. 【附源码】计算机毕业设计SSM期刊在线投稿系统
  18. 思科交换机-常用命令及配置
  19. 性能提升30倍丨基于 DolphinDB 的 mytt 指标库实现
  20. DEMATEL-ISM模型的Python实现——方法介绍以及代码复现

热门文章

  1. Appium移动自动化
  2. centos7 pe系统安装_如何用U盘安装CentOS7系统
  3. 京东联盟开发(6)——推广链接解析SKUID
  4. 计算机系技能比赛黑板报,关于技能比武主题的黑板报
  5. swiper插件实现轮播图
  6. John Ripper的模式和配置
  7. TCP协议和UDP协议的区别及其应用
  8. 蓝桥杯 我们的征途是星辰大海 Java
  9. #ifndef的神仙用法
  10. 傲视天地 页游 一键端 自玩