mysql火焰图_如何读懂火焰图?

MySQL火焰图是性能分析的重要工具,通过SVG图片展示CPU调用栈,帮助识别性能瓶颈。本文介绍了如何使用perf命令获取数据,理解火焰图的含义、互动性,以及在Node应用和浏览器中的使用,并提供了相关资源链接。
摘要由CSDN通过智能技术生成

95cc34d26614f552ffefa1619ce0374c.png

软件的性能分析,往往需要查看 CPU 耗时,了解瓶颈在哪里。火焰图(flame graph)是性能分析的利器。本文介绍它的基本用法。-- 阮一峰

本文导航◈ 一、perf 命令04%◈ 二、火焰图的含义23%◈ 三、互动性36%◈ 四、火焰图示例51%◈ 五、局限72%◈ 六、Node 应用的火焰图77%◈ 七、浏览器的火焰图83%◈ 八、参考链接94%转载自 | http://www.ruanyifeng.com/blog/2017/09/flame-graph.html 作者 | 阮一峰

软件的性能分析,往往需要查看 CPU 耗时,了解瓶颈在哪里。火焰图flame graph[1]是性能分析的利器。本文介绍它的基本用法。

一、perf 命令

让我们从 perf 命令(performance 的缩写)讲起,它是 Linux 系统原生提供的性能分析工具,会返回 CPU 正在执行的函数名以及调用栈stack。

通常,它的执行频率是 99Hz(每秒 99 次),如果 99 次都返回同一个函数名,那就说明 CPU 这一秒钟都在执行同一个函数,可能存在性能问题。

$ sudo perf record -F 99 -p 13204 -g -- sleep 30

上面的代码中,perf record表示记录,-F 99表示每秒 99 次,-p 13204是进程号,即对哪个进程进行分析,-g表示记录调用栈,sleep 30则是持续30秒。

运行后会产生一个庞大的文本文件。如果一台服务器有 16 个 CPU,每秒抽样 99 次,持续 30 秒,就得到 47,520 个调用栈,长达几十万甚至上百万行。

为了便于阅读,perf record命令可以统计每个调用栈出现的百分比,然后从高到低排列。

$ sudo perf report -n --stdio

71acff61429a5b0290ba584fe81b19d3.png

这个结果还是不易读,所以才有了火焰图。

二、火焰图的含义

火焰图是基于 perf 结果产生的 SVG 图片[2],用来展示 CPU 的调用栈。

95cc34d26614f552ffefa1619ce0374c.png

y 轴表示调用栈,每一层都是一个函数。调用栈越深,火焰就越高,顶部就是正在执行的函数,下方都是它的父函数。

x 轴表示抽样数,如果一个函数在 x 轴占据的宽度越宽,就表示它被抽到的次数多,即执行的时间长。注意,x 轴不代表时间,而是所有的调用栈合并后,按字母顺序排列的。

火焰图就是看顶层的哪个函数占据的宽度最大。只要有“平顶”plateaus,就表示该函数可能存在性能问题。

颜色没有特殊含义,因为火焰图表示的是 CPU 的繁忙程度,所以一般选择暖色调。

三、互动性

火焰图是 SVG 图片[3],可以与用户互动。

(1)鼠标悬浮

火焰的每一层都会标注函数名,鼠标悬浮时会显示完整的函数名、抽样抽中的次数、占据总抽样次数的百分比。下面是一个例子。

mysqld'JOIN::exec (272,959 samples, 78.34 percent)

(2)点击放大

在某一层点击,火焰图会水平放大,该层会占据所有宽度,显示详细信息。

f446150face359afd967cd044727a776.png

左上角会同时显示 “Reset Zoom”,点击该链接,图片就会恢复原样。

(3)搜索

按下 Ctrl + F 会显示一个搜索框,用户可以输入关键词或正则表达式,所有符合条件的函数名会高亮显示。

四、火焰图示例

下面是一个简化的火焰图例子。

首先,CPU 抽样得到了三个调用栈。

func_c

func_b

func_a

start_thread

func_d

func_a

start_thread

func_d

func_a

start_thread

上面代码中,start_thread是启动线程,调用了func_a。后者又调用了func_b和func_d,而func_b又调用了func_c。

经过合并处理后,得到了下面的结果,即存在两个调用栈,第一个调用栈抽中1次,第二个抽中2次。

start_thread;func_a;func_b;func_c 1

start_thread;func_a;func_d 2

有了这个调用栈统计,火焰图工具[4]就能生成 SVG 图片。

19b26cd208b31e02b655b618d872a336.png

上面图片中,最顶层的函数g()占用 CPU 时间最多。d()的宽度最大,但是它直接耗用 CPU 的部分很少。b()和c()没有直接消耗 CPU。因此,如果要调查性能问题,首先应该调查g(),其次是i()。

另外,从图中可知a()有两个分支b()和h(),这表明a()里面可能有一个条件语句,而b()分支消耗的 CPU 大大高于h()。

五、局限

两种情况下,无法画出火焰图,需要修正系统行为。

(1)调用栈不完整

当调用栈过深时,某些系统只返回前面的一部分(比如前 10 层)。

(2)函数名缺失

有些函数没有名字,编译器只用内存地址来表示(比如匿名函数)。

六、Node 应用的火焰图

Node 应用的火焰图就是对 Node 进程进行性能抽样,与其他应用的操作是一样的。

$ perf record -F 99 -p `pgrep -n node` -g -- sleep 30

详细的操作可以看这篇文章[5]。

七、浏览器的火焰图

Chrome 浏览器可以生成页面脚本的火焰图,用来进行 CPU 分析。

打开开发者工具,切换到 Performance 面板。然后,点击“录制”按钮,开始记录数据。这时,可以在页面进行各种操作,然后停止"录制"。

这时,开发者工具会显示一个时间轴。它的下方就是火焰图。

efe58064d71923f08e9ab61f25be5fa8.png

浏览器的火焰图与标准火焰图有两点差异:它是倒置的(即调用栈最顶端的函数在最下方);x 轴是时间轴,而不是抽样次数。

9563a7e6df6677d1f7d8e2263ea9d2cb.png

八、参考链接

◈ 火焰图的介绍论文[6]◈ 火焰图官方主页[7]◈ 火焰图生成工具[8]文内相关链接,请访问“原文链接”获得可点击的链接!

[1]: 火焰图 - http://www.brendangregg.com/flamegraphs.html

[2]: SVG 图片 - http://queue.acm.org/downloads/2016/Gregg4.svg

[3]: SVG 图片 - http://queue.acm.org/downloads/2016/Gregg4.svg

[4]: 火焰图工具 - https://github.com/brendangregg/FlameGraph

[5]: 这篇文章 - http://www.brendangregg.com/blog/2014-09-17/node-flame-graphs-on-linux.html

[6]: 火焰图的介绍论文 - http://queue.acm.org/detail.cfm?id=2927301

[7]: 火焰图官方主页 - http://www.brendangregg.com/flamegraphs.html

[8]: 火焰图生成工具 - https://github.com/brendangregg/FlameGraph

推荐文章

< 左右滑动查看相关文章 >

  • 0
    点赞
  • 1
    收藏
    觉得还不错? 一键收藏
  • 0
    评论
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值