常见GC算法介绍

概述

JVM在进行GC时,并非每次都对上面三个内存区域一起回收的,大部分时候回收的都是指新生代。因此GC按照回收的区域又分了两种类型,一种是普通GC(minor GC),一种是全局GC(major GC or Full GC)

Minor GC和Full GC的区别

  • 普通GC(minor GC):只针对新生代区域的GC,指发生在新生代的垃圾收集动作,因为大多数Java对象存活率都不高,所以Minor GC非常频繁,一般回收速度也比较快。
  • 全局GC(major GC or Full GC):指发生在老年代的垃圾收集动作,出现了Major GC,经常会伴随至少一次的Minor GC(但并不是绝对的)。Major GC的速度一般要比Minor GC慢上10倍以上

Full GC比Minor GC慢的原因:Full GC需要扫描的空间更大,且Full GC的回收算法效率较低耗时长。

引用计数法

给每一个对象都加一个引用计数器,该对象每被引用一次计数器就+1,没有被引用计数器就-1,当减到0时,表明该对象不再被使用了。

JVM的实现一般不采用这种方式。微软公司的COM技术和python就使用了这种算法进行内存管理。

缺点

  • 每次对象赋值时都要维护引用计数器,且计数器本身也有一定的消耗。
  • 难以处理循环引用。

复制算法(Copying)

新生代中使用的是Minor GC,这种GC算法采用的是复制算法。

HotSpot JVM把年轻代分为了三部分:1个Eden区和2个Survivor区(分别叫from和to)。默认比例为8:1:1,一般情况下,新创建的对象都会被分配到Eden区(一些大对象特殊处理),这些对象经过第一次Minor GC后,如果仍然存活,将会被移到Survivor区。对象在Survivor区中每熬过一次Minor GC,年龄就会增加1岁,当它的年龄增加到一定程度时,就会被移动到年老代中。因为年轻代中的对象基本都是朝生夕死的(90%以上),所以在年轻代的垃圾回收算法使用的是复制算法,复制算法的基本思想就是将内存分为两块,每次只用其中一块,当这一块内存用完,就将还活着的对象复制到另外一块上面。复制算法不会产生内存碎片。

在这里插入图片描述
在GC开始的时候,对象只会存在于Eden区和名为“From”的Survivor区,Survivor区“To”是空的。紧接着进行GC,Eden区中所有存活的对象都会被复制到“To”,而在“From”区中,仍存活的对象会根据他们的年龄值来决定去向。年龄达到一定值(年龄阈值,可以通过-XX:MaxTenuringThreshold来设置)的对象会被移动到年老代中,没有达到阈值的对象会被复制到“To”区域。经过这次GC后,Eden区和From区已经被清空。**这个时候,“From”和“To”会交换他们的角色,也就是新的“To”就是上次GC前的“From”,新的“From”就是上次GC前的“To”。**不管怎样,都会保证名为To的Survivor区域是空的。Minor GC会一直重复这样的过程,直到“To”区被填满,“To”区被填满之后,会将所有对象移动到年老代中。

动态图
在这里插入图片描述

因为Eden区对象一般存活率较低,一般的,使用两块10%的内存作为空闲和活动区间,而**另外80%的内存,则是用来给新建对象分配内存的。**一旦发生GC,将10%的from活动区间与另外80%中存活的eden对象转移到10%的to空闲区间,接下来,将之前90%的内存全部释放,以此类推。

优点:

  • 效率高。没有标记清除的过程。
  • 不会产生内存碎片。可以利用bump-the-pointer实现快速内存分配。

缺点:

  • 耗费内存空间。复制算法需要额外的一块空间进行复制,每次只能使用其中的一块空间。
  • 只适用于对象存活率比较低的情况。当对象存活率较高时,那么需要将大部分的对象都复制以便,所引用的地址也要重置一遍,效率将变得很低。

标记清除(Mark-Sweep)

老年代一般是由 标记清除 或者是 标记清除与标记整理的混合 实现

当程序运行期间,若可以使用的内存被耗尽的时候,GC线程就会被触发并将程序暂停,随后将要回收的对象标记一遍最终统一回收这些对象,完成标记清理工作接下来便让应用程序恢复运行。
主要进行两项工作:标记清除

  • 标记:从引用根节点开始标记遍历所有的GC Roots, 先标记出要回收的对象。
  • 清除:遍历整个堆,把标记的对象清除。

动态图
在这里插入图片描述
优点

  • 不需要额外的空间。

缺点

  • 效率较低。标记清除的过程比较耗时(递归与全堆对象遍历),且在进行GC的时候需要停止应用程序。
  • 会产生内存碎片。这种清理出来的空闲内存是不连续的。

标记压缩算法(Mark-Compact)

老年代一般是由标记清除或者是标记清除与标记整理的混合实现。

标记压缩算法,就是在标记清除的算法基础上多加了一个“压缩”步骤,用来解决内存碎片的问题。
在这里插入图片描述

在整理压缩阶段,不再对标记的对像做回收,而是通过所有存活对像都向一端移动,然后直接清除边界以外的内存。
可以看到,标记的存活对象将会被整理,按照内存地址依次排列,而未被标记的内存会被清理掉。如此一来,当我们需要给新对象分配内存时,JVM只需要持有一个内存的起始地址即可,这比维护一个空闲列表显然少了许多开销。

标记压缩算法不仅可以弥补标记清除算法当中,内存区域分散的缺点,也消除了复制算法当中,内存减半的高额代价

动态图
在这里插入图片描述
优点

  • 节约内存,不需要额外的内存空间。
  • 不会产生内存碎片。

缺点

  • 效率低。不仅要标记所有存活对象,还要整理所有存活对象的引用地址。从效率上来说,标记压缩算法要低于复制算法。

为了减少移动对象的成本,实际应用中可以采用标记清除与标记压缩的结合使用来解决:在进行多次标记清除后,再使用一次压缩

总结

  • 执行效率(时间复杂度):复制算法 > 标记清除算法 > 标记压缩算法。
  • 内存整齐度:复制算法 = 标记压缩算法 > 标记清除算法。
  • 内存利用率:标记压缩算法 = 标记清除算法 > 复制算法。

可以看出,效率上来说,复制算法是当之无愧的老大,但是却浪费了太多内存,而为了尽量兼顾上面所提到的三个指标,标记/整理算法相对来说更平滑一些,但效率上依然不尽如人意,它比复制算法多了一个标记的阶段,又比标记/清除多了一个整理内存的过程。

没有最好的算法,只有最合适的算法。

年轻代(Young Gen)

  • 年轻代特点是区域相对老年代较小,对像存活率低。
  • 这种情况复制算法的回收整理,速度是最快的。复制算法的效率只和当前存活对像大小有关,因而很适用于年轻代的回收。而复制算法内存利用率不高的问题,通过hotspot中的两个survivor的设计得到缓解。

老年代(Tenure Gen)

  • 老年代的特点是区域较大,对像存活率高。
  • 这种情况,存在大量存活率高的对像,复制算法明显变得不合适。一般是由标记清除或者是标记清除与标记整理的混合实现。
  • Mark阶段的开销与存活对像的数量成正比,这点上说来,对于老年代,标记清除或者标记整理有一些不符,但可以通过多核/线程利用,对并发、并行的形式提标记效率。
  • Sweep阶段的开销与所管理区域的大小形正相关,但Sweep“就地处决”的特点,回收的过程没有对像的移动。使其相对其它有对像移动步骤的回收算法,仍然是效率最好的。但是需要解决内存碎片问题。
  • Compact阶段的开销与存活对像的数据成开比,如上一条所描述,对于大量对像的移动是很大开销的,做为老年代的第一选择并不合适。

基于上面的考虑,老年代一般是由标记清除或者是标记清除与标记整理的混合实现。以hotspot中的CMS回收器为例,CMS是基于Mark-Sweep实现的,对于对像的回收效率很高,而对于碎片问题,CMS采用基于Mark-Compact算法的Serial Old回收器做为补偿措施:当内存回收不佳(碎片导致的Concurrent Mode Failure时),将采用Serial Old执行Full GC以达到对老年代内存的整理。

  • 0
    点赞
  • 1
    收藏
    觉得还不错? 一键收藏
  • 0
    评论
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值