概述:
说起垃圾收集,大部分人都把这项技术当做Java语言的伴生产物。事实上,GC的历史比Java久远,1960年诞生于MIT的Lisp是第一门真正使用内存动态分配和垃圾收集技术的语言。当Lisp还在胚胎时期时,人们就在思考GC需要完成哪些事情。
在上篇博客中说到程序计数器、虚拟机栈和本地方法栈这3个区域是线程私有的,它们随着线程而生,随线程而灭,而Java堆和方法区则不一样,一个接口中的多个实现类需要的内存可能不一样,一个方法中的多个分支需要的内存也可能不一样,我们只有在程序中处于运行期间时才能知道会创建哪些对象,这部分内存的分配和回收都是动态的,所以垃圾收集器所关注的就是这部分内存。
一、 哪些对象需要回收?
Java堆中存在着许多的对象,所以在垃圾回收之前首先要判断哪些对象是死的,需要被回收,哪些对象还存在引用,不能被回收。
(1)引用计数算法
1.1 算法分析 :
引用计数算法就是给对象添加一个引用计数器,每当有一个地方引用它时,计数器值就加1;当引用失效时,计数器值就减1;任何时刻计数器为0的对象就是不可能再被使用的。
1.2 算法优缺点:
优点: 引用计数算法的实现简单,效率高。
缺点: 它很难解决对象之间相互应引用的问题。例如下面例子:
例子中对象objA和objB都有字段obj,赋值令 objA.obj = objB 及 objB.obj = objA,除此之外,这两个对象再无任何引用,实际上这两个对象已经不可能再被访问到,但是它们因为相互引用着对方,导致它们的引用计数都不为0,于是引用计数算法无法通知GC收集器回收它们。
(2)可达性分析算法
1. 算法分析 :
这个算法的基本思路就是通过一系列的称为“GC Roots”的对象作为起始点,从这些节点开始向下搜索,搜索所走过的路径称为引用链,当一个对象到GC Roots没有任何引用链相连时,则证明此对象不可用。
如上图中对象object 5、object 6、object 7 虽然互相有关联,但是它们到GC Roots是不是可达的,所以它们将会被判定为是可回收的对象。
在Java语言中,可作为GC Roots 的对象包括下面几种:
- 虚拟机栈(栈帧中的本地变量表)中引用的对象。
- 方法区中类静态属性引用的对象。
- 方法区中常量引用的对象。
- 本地方法栈中JNI(即一般说的Native方法)引用的对象。
二、垃圾回收算法
1. 标记-清除算法
最基础的收集算法是“标记-清除”算法,如同它的名字一样,算法分为“标记”和“清除”两个阶段:首先标记出所有需要回收的对象,在标记完成后统一回收所有被标记的对象。它的主要不足有两个:一个是效率问题,标记和清除两个过程的效率都不高;另一个是空间问题,标记清除之后会产生大量不连续的内存碎片,空间碎片太多可能会导致以后在程序运行过程中需要分配较大对象时,无法找到足够的连续内存而不得不提前触发另一次垃圾收集动作。
2. 复制算法
复制算法就是把可用的内存分成两块,每次只使用其中一块,但其中一块内存满了的话,就把内存中还存活的对象复制到另一块上面,然后将刚才那块上的对象全部清除。这种算法实现简单,运行高效,但是有个缺点就是将原本可用的内存缩小为原来的一半。
现在的商业虚拟机都采用这种算法来回收新生代,IBM公司研究表明,新生代中的对象98%是“朝生夕死”,所以不需要用1:1的方式来分配内存,而是将内存分成一块较大的Eden空间和两块较小的Survivor空间,HotSpot虚拟机中Eden空间和Survivor空间的比例是8:1,每次使用Eden和一块Survivor。当回收时,将Eden和Survivor上面还存活的对象一次性复制到另一块没使用的Survivor上面,如果这块Survivor的空间不够用时,就需要依赖其他内存进行分配担保。最后清掉Eden和刚才使用的Survivor空间。
3. 标记-整理算法
在老年代中,对象的存活率很高,用复制算法的就会进行很多的复制操作,这时候复制算法的效率就会降低,所以为了应对存活率较高的老年代,有人提出来标记-整理算法。
标记-整理算法中的标记过程跟“标记-清除”算法一样,只不过标记-整理算法在标记完之后并不是将可回收对象马上清理掉,而是将所有存活的对象往一端移动,然后清除掉端边界以外的内存。
4. 分代收集算法
根据对象存活周期的不同将内存划分为几块,一般是把Java堆分为新生代和老年代,这样就可以根据各个年代的特点采用最适合的收集算法。在新生代中,每次垃圾收集时都发有大批对象死去,只有少量存活,那就选用复制算法,只需要付出少量存活对象的复制成本就可以完成收集。而老年代中因为对象存活率高、没有额外空间对它进行分配担保,就必须使用“标记-清理” 或者“标记-整理”算法进行回收。