JVM垃圾收集器G1

最新推荐文章于 2024-08-06 14:16:48 发布

卡卡罗西

最新推荐文章于 2024-08-06 14:16:48 发布

阅读量495

点赞数 1

分类专栏：知识积累文章标签： java

本文链接：https://blog.csdn.net/yanghenan19870513/article/details/108915261

版权

知识积累专栏收录该内容

32 篇文章 0 订阅

订阅专栏

G1 (Garbage-First)是一款面向服务器的垃圾收集器,主要针对配备多颗处理器及大容量内存的机
器. 以极高概率满足GC停顿时间要求的同时,还具备高吞吐量性能特征.

在这里插入图片描述

在这里插入图片描述
G1将java堆划分为多个大小相等的区域（Region），JVM最多可以有2048个Region。
一般Region的大小等于堆大小除以2048，比如堆大小为4096M，则Region的大小为2M，当然也可以用参数“-XX:G1HeapRegionSize”手动指定Region大小，但是推荐默认的计算方式。

G1保留了年轻代和老年代的概念，但不再是物理隔阂了，它们都是(可以不连续的)Region的集合。

默认年轻代堆堆内存的占比是5%，如果堆内存的大小为4096M,那么年轻代占据200M左右的内存，对应大概是100个Region,可以通过“-XX:G1NewSizePercent”设置新生代初始占比，在系统运行中，JVM会不停的给年轻代增加更多的Region，但是最多新生代占比不会超过60%，可以通过“-XX:G1MaxNewSizePercent”调整。年轻代中的Eden和Survivor对应的region也跟之前一样，默认8:1,假设年轻代有1000个region,eden区对应800个，s0对应100个，s1对应100个。

一个Region可能之前是年轻代，如果Region进行了垃圾回收，之后可能又会编程老年代。也就是说Region的区域功能可能会动态变化。

G1垃圾收集器对于对象神时候会转移到老年代个之前讲过的原则一样，最大的不同是对大对象的处理，G1有专门分配大对象的Region叫Humongous区，而不是让大对象直接进行老年代的Region中。在G1中，大对象的判定规则就是一个大对象超过了一个Region的50%，比如按照上面算的，每个Region是2M,只要一个对象超过了1M,就会被放入Humongous中，而且一个大对象如果太大，可能会横跨多个Region来存放。Humongous区专门存放短期巨型对象，不用直接进老年代，可以节约老年代的空间，避免因为老年代空间不够的GC开销。Full GC的时候除了收集年轻代和老年代之外，也会将homongous区一并回收。

G1收集器一次GC的运作过程大致分为以下几个步骤：

初始标记
initial,STW,暂停所有其他线程，并记录下gc roots直接能引用的对象，速度很快。
并发标记：同CMS的并发标记
最终标记：同CMS的重新标记
筛选标记
筛选回收阶段首先对各个Region的回收价值和成本进行排序，根据用户所期望的GC停顿时间（可以用JVM参数：-XX:MaxGCPauseMillis指定）来制定回收计划。比如说老年代此时有1000个Region都满了，但是因为根据预期停顿时间，本次垃圾回收可能只能停顿200毫秒，那么通过之前回收成本计算得知，可能回收其中800个Region刚好需要200ms,那么就只会回收800个Region，尽量把GC导致的停顿时间控制在我们指定的范围内。这个阶段其实也可以做到与用户程序一起并发执行。但是因为只回收一部分Region,时间是用户可控制的，而且停顿用户线程将大幅提高收集效率。不管是年轻代活着是老年代，回收算法主要是复制算法，将一个region中存活的对象复制到另一个region中，这种不会像CMS那样回收玩因为有很多内存碎片还需要整理一次。G1采用复制算法回收几乎不会有太多内存碎片。

在这里插入图片描述
G1收集器在后台维护了一个优先列表，每次根据允许的收集时间，优先选择回收价值最大的Region(这也就是Garbage-First的由来)，比如一个Region花200ms能回收10M垃圾，另外一个Region花50ms能回收20M垃圾，在回收时间有限情况下，G1当然会优先选择这个Region回收。这种使用Region划分内存空间以及有优先级的区域回收方式，保证了G1收集器在有限的时间内可以尽可能高的收集效率。

被视为JDK1.7以上版本java虚拟机的一个重要的进化特征。它具备以下特点：

并行与并发：G1能充分利用CPU、多核环境下的硬件优势，使用多个CPU(CPU或者CPU核心)来缩短stop-the-world的停顿时间。部分其他收集器原本需要停顿java线程来执行GC动作，G1收集器仍然可以通过并发的方式让java程序继续执行。
分带收集：虽然G1可以不需要其他收集器配合就能管理整个GC堆，但是还是保留了分代的概念。
空间整合：与CMS的“标记-清除”算法不同，G1整体来看是基于“标记整理”算法实现的收集器；从局部上看是基于“复制”算法实现的。
可预测的停顿：这是G1相对于CMS的另一个大优势，降低停顿时间是G1和CMS共同的关注点，但G1除了追求低停顿外，还能建立可预测的停顿时间模型，能让使用者明确指定一个长度为M毫秒的时间片段（通过参数“-XX:MaxGCPauseMillis”指定）内完成垃圾收集。

G1收集器参数设置
-XX:+UseG1GC:使用G1收集器
-XX:ParallelGCThreads:指定GC工作的线程数量
-XX:G1HeapRegionSize:指定分区大小(1MB~32MB，且必须是2的幂)，默认将整堆划分为2048个分区
-XX:MaxGCPauseMillis:目标暂停时间(默认200ms)
-XX:G1NewSizePercent:新生代内存初始空间(默认整堆5%)
-XX:G1MaxNewSizePercent:新生代内存最大空间
-XX:TargetSurvivorRatio:Survivor区的填充容量(默认50%)，Survivor区域里的一批对象(年龄
1+年龄2+年龄n的多个年龄对象)总和超过了Survivor区域的50%，此时就会把年龄n(含)以上的对象都放入老年代
-XX:MaxTenuringThreshold:最大年龄阈值(默认15)
-XX:InitiatingHeapOccupancyPercent:老年代占用空间达到整堆内存阈值(默认45%)，则执行新生代和老年代的混合收集(MixedGC)，比如我们之前说的堆默认有2048个region，如果有接近1000个region都是老年代的region，则可能就要触发MixedGC了
-XX:G1HeapWastePercent(默认5%): gc过程中空出来的region是否充足阈值，在混合回收的时
候，对Region回收都是基于复制算法进行的，都是把要回收的Region里的存活对象放入其他Region，然后这个Region中的垃圾对象全部清理掉，这样的话在回收过程就会不断空出来新的
Region，一旦空闲出来的Region数量达到了堆内存的5%，此时就会立即停止混合回收，意味着
本次混合回收就结束了。
-XX:G1MixedGCLiveThresholdPercent(默认85%) region中的存活对象低于这个值时才会回收
该region，如果超过这个值，存活对象过多，回收的的意义不大。
-XX:G1MixedGCCountTarget:在一次回收过程中指定做几次筛选回收(默认8次)，在最后一个筛
选回收阶段可以回收一会，然后暂停回收，恢复系统运行，一会再开始回收，这样可以让系统不至
于单次停顿时间过长。

G1垃圾收集分类
YoungGC
YoungGC并不是说现有的Eden区放满了就会马上触发，而且G1会计算下现在Eden区回收大概要多久时间，如果回收时间远远小于参数 -XX:MaxGCPauseMills 设定的值，那么增加年轻代的region，继续给新对象存放，不会马上做Young GC，直到下一次Eden区放满，G1计算回收时间接近参数 -XX:MaxGCPauseMills 设定的值，那么就会触发Young GC

MixedGC
不是FullGC，老年代的堆占有率达到参数(-XX:InitiatingHeapOccupancyPercen)设定的值则触发，回收所有的Young和部分Old(根据期望的GC停顿时间确定old区垃圾收集的优先顺序)以及大对象区，正常情况G1的垃圾收集是先做MixedGC，主要使用复制算法，需要把各个region中存活的对象拷贝到别的region里去，拷贝过程中如果发现没有足够的空region能够承载拷贝对象就会触发一次Full GC
Full GC停止系统程序，然后采用单线程进行标记、清理和压缩整理，好空闲出来一批Region来供下
一次MixedGC使用，这个过程是非常耗时的。

G1垃圾收集器优化建议
假设参数 -XX:MaxGCPauseMills 设置的值很大，导致系统运行很久，年轻代可能都占用了堆
内存的60%了，此时才触发年轻代gc。

那么存活下来的对象可能就会很多，此时就会导致Survivor区域放不下那么多的对象，就会进入老年代中。或者是你年轻代gc过后，存活下来的对象过多，导致进入Survivor区域后触发了动态年龄判定规则，达到了Survivor区域的50%，也会快速导致一些对象进入老年代中。

所以这里核心还是在于调节 -XX:MaxGCPauseMills 这个参数的值，在保证他的年轻代gc别太
频繁的同时，还得考虑每次gc过后的存活对象有多少,避免存活对象太多快速进入老年代，频繁触
发mixed gc.

每秒几十万并发的系统如何优化JVM

Kafka类似的支撑高并发消息系统大家肯定不陌生，对于kafka来说，每秒处理几万甚至几十万消息时很正常的，一般来说部署kafka需要用大内存机器(比如64G)，也就是说可以给年轻代分配个三四十G的内存用来支撑高并发处理，这里就涉及到一个问题了，我们以前常说的对于eden区的young gc是很快的，这种情况下它的执行还会很快吗？很显然，不可能，因为内存太大，处理还是要花不少时间的，假设三四十G内存回收可能最快也要几秒钟，按kafka这个并发量放满三四十G的eden区可能也就一两分钟吧，那么意味着整个系统每运行一两分钟就会因为young gc卡顿几秒钟没法处理新消息，显然是不行的。那么对于这种情况如何优化了，我们可以使用G1收集器，设置 -XX:MaxGCPauseMills 为50ms，假设50ms能够回收三到四个G内存，然后50ms的卡顿其实完全能够接受，用户几乎无感知，那么整个系统就可以在卡顿几乎无感知的情况下一边处理业务一边收集垃圾。G1天生就适合这种大内存机器的JVM运行，可以比较完美的解决大内存垃圾回收时间过长的问题。