爆肝整理-JVM垃圾回收

前言

面试中经常会被问到的问题:

  • 如何判断对象是否死亡(两种方法)。
  • 简单的介绍一下强引用、软引用、弱引用、虚引用(虚引用与弱引用和弱引用的区别、使用软引用带来的好处)。
  • 如何判断一个常量是废弃常量?
  • 如何判断一个类是无用的类?
  • 垃圾收集有哪些算法,各自的特点?
  • HotSpot 为什么要分为新生代和老年代?
  • 常见的垃圾回收器有哪些?
  • 介绍一下CMS、G1 收集器。
  • Minor Gc 和 Full Gc 有什么区别?

1. JVM 内存分配与回收的神秘面纱

Java 内存模型不再详细叙述,具体可以看下这篇文章哦:《爆肝整理–Java内存区域》

1.1. 对象优先在 eden 区分派

目前主流的垃圾收集器都会采用分代回收算法,因此需要将堆内存分为新生代和老生代,这样我们就可以根据各个年代的特点选择合适的垃圾收集算法。

大多数情况下,对象在新生中 eden 区分配。当 eden 区没有足够的空间进行分配时,虚拟机将发起一次 Minor Gc

1.2. 大对象直接进入老年代

大对象就是需要大量连续内存空间的对象(比如:字符串、数组)。

为什么这样呢?

为了避免为大对象分配内存时由于分配担保机制带来的复制而降低效率。

1.3. 长期存活的对象将进入老年代

既然虚拟机采用了分代收集的思想来管理内存,那么内存回收时就必须识别哪些对象应该放在新生代,哪些对象应该放在老年代中。为了做到这一点,虚拟机给每个对象一个对象年龄(Age)计数器。

如果对象在 Eden 出生并经过第一次 Minor GC 后能够仍然存活,并且能被 Survivor 容纳的话,将被移动到Survivor 空间中,并将对象年龄设为 1 。对象在 Survivor 中没熬过一次 Minor GC ,年龄就增加 1 岁,当它的年龄到达一定程度(默认为15岁),就会被晋升到老年代中。对象晋升到老年代的年龄阈值,可以通过参数:-XX:MaxTenuringThreadshold 来设置。

1.4. 主要进行 GC 的区域

针对 HotSpot VM 的实现,它里面的 GC 其实准确分类只有两大种:

1. 部分收集(Partial GC):

  • 新生代收集(Minor GC / Young GC): 只对新生代进行垃圾收集。
  • 老年代收集(Major GC / Old GC): 只对老年代进行垃圾收集,需要注意的是 Major GC 在有的意境中也用于指代整堆收集。
  • 混合收集(Mixed GC): 对整个新生代和部分老生代进行垃圾收集。

2.整堆收集(Full GC):

  • 收集整个 Java 堆 和 方法区。

2. 如何判断对象已经死亡?

堆中几乎放着所有的对象实例,对堆垃圾回收前的第一步就是要判断哪些对象已经死亡(即不能再被任何途径使用的对象)。

在这里插入图片描述

2.1. 引用计数法

给对象中添加一个引用计数器,每当有一个地方引用它,计数器就 加1 ;当引用失效,计数器就 减1 ;任何时候计数器为 0 的对象就是不可能再被使用的。

这个方法实现简单、效率高,但是目前主流的虚拟机并没有选择这个算法来管理内存,其最主要的原因是它很难解决对象之间相互循环引用的问题。 所谓对象之间的相互引用问题,如下面代码所示:除了对象 objA 和 objB 相互引用着对方之外,这两个对象之间再无任何引用。但是他们因为互相引用对方,导致它们的引用计数器都不为 0,于是引用计数算法无法通知 GC 回收器回收他们。

public class ReferenceCountingGcTest {
    Object instance = null;
  
		public static void main(String[] args) {
        ReferenceCountingGc objA = new ReferenceCountingGc();
        ReferenceCountingGc objB = new ReferenceCountingGc();
        objA.instance = objB;
        objB.instance = objA;
        objA = null;
        objB = null;
	}
}

2.2. 可达性分析算法

这个算法的基本思想就是通过一系列的称为 “GC Roots” 的对象作为起点,从这些节点开始向下搜索,节点所走过的路径称为引用链,当一个对象到 “GC Roots” 没有任何引用链相连的话,则证明此对象是不可用的。

在这里插入图片描述

如上图所示,Obejct1 ~ Object4对GC Root 来说都是可达的,说明不可回收;Object5 和 Object6 对GC Root 节点是不可达的,说明其可以被回收。

可作为 GC Roots 的对象包括以下几种:

  • 虚拟机栈(栈帧中的本地变量表)中引用的对象
  • 本地方法栈(Native 方法)中引用的对象
  • 方法区中类静态属性引用的对象
  • 方法区中常量引用的对象
  • 所有被同步锁持有的对象

2.3. 再谈引用

无论是通过 引用计数法 判断对象引用数量,还是通过 可达性分析法 判断对象的引用链是否可达,判断对象的存活都与 “引用” 相关。

JDK 1.2 之前,Java中引用的定义很传统:如果 reference 类型的数据存储的数值代表是另一块内存的起始地址,就称这块内存代表一个引用。

JDK 1.2 之后,Java对引用的概念进行了扩充,将引用分为强引用、软引用、弱引用、虚引用四种。(引用强度逐渐减弱)

1. 强引用(Strong Reference)

以前我们使用的大部分引用都是强引用,这是使用最普遍的引用。如果一个对象具有强引用,那就类似于 必不可少的 ,垃圾回收器绝不会回收它。当内存空间不足,Java虚拟机宁愿抛出 OutOfMemoryError 错误,使程序异常终止,也不会靠随意回收具有强引用的对象来解决内存不足问题。

2. 软引用(Soft Reference)

如果一个对象只具有软引用,那就类似于 可有可无的生活用品 。当内存空间足够,垃圾回收器就不会回收它,如果内存空间不足了,就会回收这些对象的内存。只要垃圾回收器没有回收它,该对象就可以被程序使用。软引用可用来实现内存敏感的告诉缓存。

软引用可以和一个引用队列(Reference Queue)联合使用,如果软引用引用的对象被垃圾回收,Java虚拟机就会把这个软引用加入到与之关联的引用队列中。

3. 弱引用(Weak Reference)

如果一个对象只具有弱引用,那就类似于 可有可无的生活用品 。弱引用和软引用的区别在于:只具有弱引用的对象具有更短的生命周期。在垃圾回收期线程扫描它所管辖的内存区域过程中,一旦发现了至于弱引用的对象,不管它当前内存是否足够,都会回收它的内存。不过,由于垃圾回收器是一个优先级很低的线程,因此不一定会很快发现那些只具有弱引用的对象。

弱引用可以和一个引用队列(Reference Queue)联合使用,如果弱引用所引用的对象被垃圾回收,Java虚拟机就会把这个弱引用加入到与之关联的引用队列中。

4. 虚引用(Phantom Reference)

“虚引用” 顾名思义,就是形同虚设,与其他几种引用都不同,虚引用并不会决定对象的生命周期。如果一个对象仅持有虚引用,那么它就和没有任何引用一样,在任何时候都可能会被垃圾回收。

虚引用主要用来跟踪对象被垃圾回收的活动。
虚引用与软引用和弱引用的一个区别在于: 虚引用必须和引用队列(Reference Queue)联合使用。当垃圾回收器准备回收一个对象时,如果发现它还有虚引用,就会在回收对象的内存之前,把这个虚引用加入到与之关联的引用队列中。程序可以通过判断引用队列中是否已经加入了虚引用,来了解被引用对象是否要被垃圾回收。程序如果发现某个虚引用已经加入到引用队列中,那么就可以在引用的对象的内存被回收之前来采取必要的行动。

特别注意,在程序设计中一般很少使用弱引用和虚引用,使用软引用的情况较多,这是 因为软引用可以加速 JVM 对垃圾内存的回收速度,可以维护系统的运行安全,防止内存溢出(OutofMemoryError)等问题的发生。

2.4. 不可达的对象并非 “非死不可”

就是在可达性分析法不可达的对象,也并非 ”非死不可“ 的,这时候它们暂时处于”缓刑阶段“,要真正宣告一个对象死亡,至少要经历两次标记过程,可达性分析法中不达的对象被第一次标记并且进行一次筛选,筛选的条件是此对象是否有必要执行 finalize 方法。当对象没有覆盖 finalize 方法,或者 finalize 方法已经被调用过时,虚拟机将这两种情况视为没有必要执行。

被判定为需要执行的对象会被放在一个队列中进行二次标记,除非这个对象与引用链上的任何一个对象建立关联,否则就会被真的回收。

2.5. 如何判断一个常量是废弃常量?

运行时常量池主要回收的是废弃的常量。那么,我们如何判断一个常量是废弃常量呢?

  1. JDK 1.7 之前运行时常量池逻辑包含字符串常量池存放在方法区,此时,hotspot 虚拟机对方法区的实现为永久代。
  2. JDK 1.7 字符串常量池被从方法区拿到了堆中,这里没有提到运行时常量池,也就是说字符串常量池被单独拿到堆,运行时常量池剩下的东西还在方法区,也就是 hotspot 中的永久代。
  3. JDK 1.8 hotspot移除了永久代用元空间(Metaspace)取而代之,这时候字符串常量池还在堆,运行时常量池还在方法区,只不过方法区的实现从永久代变成了元空间(Metaspace)。

假如在字符串常量池中存在字符串 ”abc“ ,如果当前没有任何String对象引用该字符串常量的话,就说明常量 ”abc“ 就是废弃常量,如果这时发生内存回收的话而且有必要的话,”abc“ 就会被系统清理出常量池了。

2.6. 如何判断一个类是无用的类

方法区主要回收的是无用的类,那么该如何判断一个类是无用的类呢?

判定一个常量是否是”废弃常量“比较简单,而要判定一个类是否是”无用的类“的条件则相对苛刻许多。类需要同时满足下面三个条件才能算是”无用的类“:

  • 该类所有的实例都已经被回收,也就是Java堆中不存在该类的任何实例。
  • 加载该类的 ClassLoader 已经被回收。
  • 该类对应的 java.lang.Class 对象没有在任何地方被引用,无法在任何地方通过反射访问该类的方法。

虚拟机可以对满足上述3个条件的无用的类进行回收,这里说的仅仅是”可以“,而并不是和对象一样不适用了就会必然被回收。

3. 垃圾收集算法

在这里插入图片描述

3.1. 标记-清除算法

该算法分为 标记清除 阶段:首先标记出所有不需要回收的对象,在标记完成后统一回收掉所有没有被标记的对象。它是最基础的收集算法,后续的算法都是对其不足进行改进得到。这种垃圾收集算法会带来两个明显的问题:

  1. 效率问题
  2. 空间问题(标记清除后会产生大量不连续的碎片)

在这里插入图片描述

3.2. 标记-复制算法

为了解决效率问题,标记-复制 算法出现了。它可以将内存分为大小相同的两块,每次使用其中的一块。当这一块的内存使用完后,就将还存活的对象复制到另一边去,然后再把使用的空间一次清理掉。这样就使每次的内存回收都是内存区间的一半进行回收。

在这里插入图片描述

3.3. 标记-整理算法

根据老年代的特点提出的一种标记算法,标记过程仍然与”标记-清除“ 算法一样,但后续的步骤不是直接对可回收对象回收,而是让所有存活的对象向一端移动,然后直接清理掉端边界以外的内存。

3.4. 分代收集算法

当前虚拟机的垃圾收集器都采用分代收集算法,这种算法没有新的思想,只是根据对象的存活周期的不同将内存分为几块。一般将 java 堆分为新生代和老年代,这样我们就可以根据各个年代的特点选择合适的垃圾收集算法。

比如在新生代中,每次收集都会有大量对象死去,所以可以选择”标记-复制“ 算法,只需要付出少量的复制成本就可以完成每次垃圾收集。而老年代的对象存活几率都是比较高的,而且没有额外的空间对它进行分配担保,所以我们必须选择 ”标记-清除“ 或 ”标记-整理“ 算法进行垃圾收集。

4. 垃圾收集器

在这里插入图片描述

如果说收集算法是内存回收的方法论,那么垃圾收集收集器就是内存回收的具体实现。

虽然我们对各个收集器进行比较,但并非要挑选出一个最好的收集器。因为直到现在为止还没有最好的垃圾收集器出现,更加没有万能的垃圾收集器,我们能做的就是根据具体应用场景选择适合自己的垃圾收集器。

4.1. Serial 收集器

Serial(串行) 收集器是最基本、历史最悠久的垃圾收集器了,这个收集器是一个单线程收集器了。它的 单线程 的意义不仅仅意味着它只会使用一条垃圾收集线程去完成垃圾收集工作,更重要的是它在进行垃圾收集工作的时候必须暂停其他所有的工作线程(”Stop The World“),知道它收集结束。

新生代采用标记-复制算法,老年代采用标记-整理算法。

在这里插入图片描述

虚拟机的设计者当然知道 ”Stop The World“ 带来的不良的用户体验,所以在后续的垃圾收集器设计中停顿时间在不断缩短(仍然还有停顿,寻找最优秀的垃圾收集器的过程仍在继续)。

但是 Serial收集器 有没有优于其他垃圾收集器的地方呢在?

当然有,它 简单而高效(与其他收集器的单线程相比)Serial 收集器 由于没有线程交互的开销,自然可以获得很高的单线程收集效率。Serial 收集器对于运行在 Client 模式下的虚拟机来说是个不错的选择。

4.2. ParNew收集器

ParNew 收集器其实就是Serial收集器的多线程版本了,除了使用多线程进行垃圾收集外,其他行为(控制参数、收集算法、回收策略等等)都和 Serial 收集器完全一样。

新生代采用 标记-复制算法 ,老年代采用 标记-整理 算法。

在这里插入图片描述

它是许多运行在 Server 模式下的虚拟机的首要选择,除了 Serial 收集器外,只有它能与 CMS 收集器(真正意义上的并发收集器,后面会介绍到)配合工作。

并行和并发概念补充:

  • 并行(Parallel): 指多条垃圾收集线程并行工作,但此时用户状态仍然处于等待状态。
  • 并发(Cocurrent): 指用户线程与垃圾收集线程同时执行(但不一定并行,可能会交替执行),用户程序在继续运行,而垃圾收集器运行在另外一个CPU上。

4.3. Parallel Scavenge 收集器

Parallen Scavenge 收集器也是使用 标记-复制算法 的多线程收集器,它看上去几乎和ParNew一样,那么它有什么特别之处呢?

-XX:+UseParallelGC

    使用 Parallel 收集器+ 老年代串行

-XX:+UseParallelOldGC

    使用 Parallel 收集器+ 老年代并行

Parallel Scavenge 收集器关注点是吞吐量(高效率的利用CPU)。CMS 等垃圾收集器的关注点更多的是用户线程的停顿时间(提高用户体验)。所谓吞吐量就是 CPU 中用于运行用户代码的时间与 CPU 总消耗时间的比值。 Parallel Scavenge 收集器提供了很多参数供用户找到最合适的停顿时间或最大吞吐量,如果对于收集器运行不太了解,手工优化存在困难的时候,使用 Parallel Scavenge 收集器配合自适应调节策略,把内存管理优化交给虚拟机去完成也是一个不错的选择。

新生代采用 标记-复制 算法,老年代采用 标记-整理 算法。

JDK 1.8 默认使用的是: Parallel Scavenge + Parallel Old ,如果指定了-XX:+UseParallelGC 参数,则默认指定了-XX:+UseParallelOldGC,可以使用-XX:-UseParallelOldGC 来禁用该功能。

4.4. Serial Old 收集器

Serial 收集器的老年代版本,它同样是一个单线程收集器。它主要有两大用途:一种用途是在 JDK1.5 以及以前的版本中与 Parallel Scavenge 收集器搭配使用,另一种用途是作为 CMS 收集器的后备方案。

4.5. Parallel Old 收集器

Parallel Scavenge 收集器的老年代版本。使用多线程和“标记-整理”算法。在注重吞吐量以及 CPU 资源的场合,都可以优先考虑 Parallel Scavenge 收集器和 Parallel Old 收集器。

4.6. CMS 收集器

CMS(Concurrent Mark Sweep)收集器是一种以获取最短回收停顿时间为目标的收集器。它非常符合在注重用户体验的应用上使用。

CMS(Concurrent Mark Sweep)收集器是 HotSpot 虚拟机第一款真正意义上的并发收集器,它第一次实现了让垃圾收集线程与用户线程(基本上)同时工作。

从名字中的Mark Sweep这两个词可以看出,CMS 收集器是一种 “标记-清除”算法实现的,它的运作过程相比于前面几种垃圾收集器来说更加复杂一些。整个过程分为四个步骤:

  • 初始标记: 暂停所有的其他线程,并记录下直接与 root 相连的对象,速度很快 。
  • 并发标记: 同时开启 GC 和用户线程,用一个闭包结构去记录可达对象。但在这个阶段结束,这个闭包结构并不能保证包含当前所有的可达对象。因为用户线程可能会不断的更新引用域,所以 GC 线程无法保证可达性分析的实时性。所以这个算法里会跟踪记录这些发生引用更新的地方。
  • 重新标记: 重新标记阶段就是为了修正并发标记期间因为用户程序继续运行而导致标记产生变动的那一部分对象的标记记录,这个阶段的停顿时间一般会比初始标记阶段的时间稍长,远远比并发标记阶段时间短。
  • 并发清除: 开启用户线程,同时 GC 线程开始对未标记的区域做清扫。

在这里插入图片描述

从它的名字就可以看出它是一款优秀的垃圾收集器,主要优点:并发收集、低停顿。但是它有下面三个明显的缺点:

  • 对 CPU 资源敏感;
  • 无法处理浮动垃圾;
  • 它使用的回收算法-“标记-清除”算法会导致收集结束时会有大量空间碎片产生。

4.7. G1 收集器

G1 (Garbage-First) 是一款面向服务器的垃圾收集器,主要针对配备多颗处理器及大容量内存的机器. 以极高概率满足 GC 停顿时间要求的同时,还具备高吞吐量性能特征.

被视为 JDK1.7 中 HotSpot 虚拟机的一个重要进化特征。它具备一下特点:

  • 并行与并发:G1 能充分利用 CPU、多核环境下的硬件优势,使用多个 CPU(CPU 或者 CPU 核心)来缩短 Stop-The-World 停顿时间。部分其他收集器原本需要停顿 Java 线程执行的 GC 动作,G1 收集器仍然可以通过并发的方式让 java 程序继续执行。
  • 分代收集:虽然 G1 可以不需要其他收集器配合就能独立管理整个 GC 堆,但是还是保留了分代的概念。
  • 空间整合:与 CMS 的“标记-清理”算法不同,G1 从整体来看是基于“标记-整理”算法实现的收集器;从局部上来看是基于“标记-复制”算法实现的。
  • 可预测的停顿:这是 G1 相对于 CMS 的另一个大优势,降低停顿时间是 G1 和 CMS 共同的关注点,但 G1 除了追求低停顿外,还能建立可预测的停顿时间模型,能让使用者明确指定在一个长度为 M 毫秒的时间片段内。

G1 收集器的运作大致分为以下几个步骤:

  • 初始标记
  • 并发标记
  • 最终标记
  • 筛选回收

G1 收集器在后台维护了一个优先列表,每次根据允许的收集时间,优先选择回收价值最大的 Region(这也就是它的名字 Garbage-First 的由来) 。这种使用 Region 划分内存空间以及有优先级的区域回收方式,保证了 G1 收集器在有限时间内可以尽可能高的收集效率(把内存化整为零)。

5. 总结

本篇文章讲解了 JVM垃圾回收。代码和笔记由于纯手打,难免会有纰漏,如果发现错误的地方,请第一时间告诉我,这将是我进步的一个很重要的环节。以后会定期更新算法题目以及各种开发知识点,如果您觉得写得不错,不妨点个关注,谢谢。

  • 1
    点赞
  • 2
    收藏
    觉得还不错? 一键收藏
  • 0
    评论

“相关推荐”对你有帮助么?

  • 非常没帮助
  • 没帮助
  • 一般
  • 有帮助
  • 非常有帮助
提交
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值