使用google-perftools剖析程序性能瓶颈

1.perftools

       google-perftool,它是由google开发的用来分析C/C++程序性能的一套工具,这里的性能分析主要包括内存和CPU两个方面,内存分析使用google-perftool所提供的tcmalloc,CPU分析使用它所提供的profiler。下面先分别介绍一下tcmalloc和profiler,然后再给出一些使用的例子,及一些使用时的注意事项。


2.详细介绍

(1)tcmalloc

       tcmalloc的全称是thread cache malloc,顾名思义,它是带有thread cache的内存管理工具。tcmalloc的主要优点有两个方面,一个是内存allocate/deallocate的速度,通常情况下它的速度比glibc所提供的malloc要快;另一个方面是小内存(< =32K)的管理,它的小内存是在thread cache里面管理的,一方面减少了加锁的开销,另一方面用来表示小内存所用的额外的空间也比较小,比较节省空间。因此,对于多线程下,经常小内存的allocation/deallocation的程序(尤其多线程下使用STL比较多的程序),可以尝试使用一下tcmalloc。
除了在allocate/deallocate内存时的优化外,tcmalloc还提供了heapcheck和heapprofile的功能。heap-check主要被用来检查程序中是否有内存泄露,在哪里泄露。tcmalloc另外一个功能是heap-profile。heap-profile,顾名思义,它就是描绘程序的heap轮廓,通过这样一个过程,我们就能知道,程序的heap里在每一时刻都有些啥东东。有了profile的结果,它可以帮助我们定位内存泄露,帮助我们发现一些频繁allocate内存的地方,以此来做一些优化。

(2)profiler

      profiler是由google-perftool所提供的用来做cpu-profile的工具。cpu-profile,它的主要功能就是通过采样的方式,给程序中cpu的使用情况进行“画像”,通过它所输出的结果,我们可以对程序中各个函数耗时情况一目了然。在对程序做性能优化的时候,这个是很重要的,先把最耗时的若干个操作优化好,程序的整体性能提升应该十分明显,这也是做性能优化的一个最为基本的原则—先优化最耗时的。


3.perftool的使用方式

关于google-perftool的使用,总体上来讲有以下三种方式:

(a)直接调用提供的api

这种方式比较适用于对于程序的某个局部来做分析的情况,直接在要做分析的局部调用相关的api即可。

(b)链接静态库

这种方式是最为常用的方式,后面会有详细的介绍。

(c)链接动态库

这种方式和静态库的方式差不多,但通常不推荐使用,除非使用者不想额外链一个静态库(因为链接静态库会增大binary的大小)的情况,可以考虑使用这种方式。


对于链接静态库的使用方式具体操作方式如下:

(1)heap-checker
gcc [...] -o myprogram -ltcmalloc
env HEAPCHECK=normal ./myprogram

(2)heap-profiler:
gcc [...] -o myprogram -ltcmalloc
env HEAPPROFILE=./myprogram.hprof ./myprogram

(3)cpu-profiler:
gcc [...] -o myprogram -lprofiler
env CPUPROFILE=./myprogram.prof ./myprogram


4.可视化转换工具pprof      

      通过上面的方法,可以生成google-perftool原始的输出结果。另外,google-perftool还提供了一个叫pprof的工具,它是一个perl的脚本,通过这个工具,可以将google-perftool的输出结果分析得更为直观,输出为图片、pdf等格式。

      假设被分析的程序二进制文件名为codeTest,perftools工具的原始结果输出为MyProfile,那么可以将原始输出转化成更友好的结果展示,如下:

#将perftools的原始输出转换成gv格式的可视化输出
pprof --gv ./codeTest MyProfile
#将perftools的原始输出转换成pdf格式的可视化输出
pprof --pdf ./codeTest MyProfile > MyProfile.pdf
      经过pprof转换格式后的可视化输出的形式可以是下面的样子:

使用google-perftools剖析程序性能瓶颈_第1张图片


学习资料来源于:

http://www.wuzesheng.com/?p=2147

http://www.ibm.com/developerworks/cn/linux/l-cn-googleperf/index.html

http://www.cnblogs.com/GODYCA/archive/2013/05/28/3104281.html

你可能感兴趣的:(使用google-perftools剖析程序性能瓶颈)