JVM对象创建与内存分配机制深度剖析

本文详细阐述了JVM中对象的创建过程,包括类加载检查、内存分配、初始化、设置对象头以及执行构造方法。讨论了对象头与指针压缩的原理,以及对象在Eden区、Survivor区的分配策略。此外,还介绍了对象内存回收机制,如引用计数法和可达性分析算法,以及如何判断一个类是否无用。最后,提供了一个日均百万级订单交易系统的JVM参数设置实例,强调了根据业务压力调整内存模型的重要性。
摘要由CSDN通过智能技术生成

一、JVM对象创建过程详解

对象创建的主要流程:
在这里插入图片描述

类加载检查

虚拟机遇到一条new指令时,首先将去检查这个指令的参数是否能在常量池中定位到一个类的符号引用,并且检查这个符号引用代表的类是否已被加载、解析和初始化过。如果没有,那必须先执行相应的类加载过程。
new指令对应到语言层面上讲是,new关键词、对象克隆、对象序列化等。

分配内存

在类加载检查通过后,接下来虚拟机将为新生对象分配内存。对象所需内存的大小在类加载完成后便可完全确定,为对象分配空间的任务等同于把 一块确定大小的内存从Java堆中划分出来。
这个步骤有两个问题:
Q1.如何划分内存
划分内存的方法
“指针碰撞”(Bump the Pointer)(默认用指针碰撞):
如果Java堆中内存是绝对规整的,所有用过的内存都放在一边,空闲的内存放在另一边,中间放着一个指针作为分界点的指示器那所分配内存就仅仅是把那个指针向空闲空间那边挪动一段与对象大小相等的距离
“空闲列表”(Free List):
如果Java堆中的内存并不是规整的,已使用的内存和空闲的内存相互交错,那就没有办法简单地进行指针碰撞了,虚拟机就必须维护一个列表,记录上哪些内存块是可用的,在分配的时候从列表中找到一块足够大的空间划分给对象实例,并更新列表上的记录

Q2.在并发情况下, 可能出现正在给对象A分配内存,指针还没来得及修改,对象B又同时使用了原来的指针来分配内存的情况
CAS(compare and swap)
虚拟机采用CAS配上失败重试的方式保证更新操作的原子性来对分配内存空间的动作进行同步处理。

本地线程分配缓冲(Thread Local Allocation Buffer,TLAB)
把内存分配的动作按照线程划分在不同的空间之中进行,即每个线程在Java堆中预先分配一小块内存。通过­XX:+/­UseTLAB参数来设定虚拟机是否使用TLAB(JVM会默认开启­XX:+UseTLAB),
-­XX:TLABSize 指定TLAB大小。(默认Ecen的1/100,如果放不下就会走CAS方法)

初始化

内存分配完成后,虚拟机需要将分配到的内存空间都初始化为零值(不包括对象头), 如果使用TLAB,这一工作过程也可以提前至TLAB分配时进行。这一步操作保证了对象的实例字段在Java代码中可以不赋初始值就直接使用,程序能访问到这些字段的数据类型所对应的零值

设置对象头

初始化零值之后,虚拟机要对对象进行必要的设置,例如这个对象是哪个类的实例、如何才能找到类的元数据信息、对象的哈希码、对象的GC分代年龄等信息。这些信息存放在对象的对象头Object Header之中。
在HotSpot虚拟机中,对象在内存中存储的布局可以分为3块区域:对象头(Header)、 实例数据(Instance Data)和对齐填充(Padding)

HotSpot虚拟机的对象头包括两部分信息,
第一部分用于存储对象自身的运行时数据, 如哈希码(HashCode)、GC分代年龄、锁状态标志、线程持有的锁、偏向线程ID、偏向时 间戳等
对象头的另外一部分是类型指针,即对象指向它的类元数据的指针,虚拟机通过这个指针来确定这个对象是哪个类的实例
还有一部分针对数组对象,会存放一个数组长度
在这里插入图片描述
Q3:那么类型指针到底是个什么玩意呢?
首先一个对象new出来之后是存放在堆里面的,在这个对象头部区域有一个类型指针,指向方法区这个对象所属的类的类元数据信息
在这里插入图片描述
比如从math.compute();找到compute方法对应的代码就是通过这个指针
在这里插入图片描述
还有一个math的类对象是放在堆区域的,它不同于方法区的类元信息(类的代码都是放在方法区的,类对象可以认为是类装载完成之后,JVM内部给开发人员提供的一个类似于镜像、入口的玩意,通过类对象可以访问类元信息(我们通过反射机制,可以拿到类的名称,方法等)),但是JVM内部去拿类元信息是通过类头部的类型指针去访问的

对象头在hotspot的C++源码里的注释如下:
在这里插入图片描述

执行方法

执行方法,即对象按照程序员的意愿进行初始化。对应到语言层面上讲,就是为属性赋值(注意,这与上面的赋零值不同,这是由程序员赋的值),和执行构造方法。

二、对象头与指针压缩详解

对象大小

对象大小可以用jol­core包查看,引入依赖
在这里插入图片描述
在这里插入图片描述

在这里插入图片描述
对象头的前面两块存储的就是mark Word,第三个就是klass point,还有一行表示的是对象对齐有的是很有有的时候没有),JVM内部会把读取的对象信息按照8个字节对齐,保证8字节的倍数如果不对齐,某个对象存储占的空间比较小,在查找对象的时候需要评估对象的大小,还需要在起始位置往后去偏移),上述可以看到对象头是12字节,所以对齐4位成16位。

数组对象的第四行表示的就是数组长度,此时已经占用16字节,所以不需要再对齐

再来看A对象,包含int,String,byte,Object变量,前三行还是对象头信息,int占4个字节,byte占一个字节(字节内部也有对齐,把byte对齐成4字节了),String占4个字节(name),Object o存的是o对象的地址指针(在64位下应该占8个字节,这里占4个,因为有指针压缩),最后是对象对齐。
在这里插入图片描述
在这里插入图片描述

指针压缩

Q4:什么是java对象的指针压缩?
1.jdk1.6 update14开始,在64bit操作系统中,JVM支持指针压缩
2.jvm配置参数:UseCompressedOops,compressed­­压缩、oop(ordinary object pointer)­­对象指针
3.启用指针压缩:-­XX:+UseCompressedOops(默认开启),
禁止指针压缩:­-XX:­UseCompressedOops

Q5:为什么要进行指针压缩?

  1. 在64位平台的HotSpot中使用32位指针,内存使用会多出1.5倍左右,使用较大指针在主内存和缓存之间移动数据,占用较大宽带,同时GC也会承受较大压力,为了减少64位平台下内存的消耗,启用指针压缩功能
  2. 在jvm中,32位地址最大支持4G内存(2的32次方),可以通过对对象指针的压缩编码、解码方式进行优化,使得jvm只用32位地址就可以支持更大的内存配置(小于等于32G)
  3. 堆内存小于4G时,不需要启用指针压缩,jvm会直接去除高32位地址,即使用低虚拟地址空间,堆内存大于32G时,压缩指针会失效,会强制使用64位(即8字节)来对java对象寻址,这就会出现1的问题,所以堆内存不要大于32G为好

三、JVM对象内存分配详解

在这里插入图片描述

逃逸分析

就是分析对象动态作用域,当一个对象在方法中被定义后,它可能被外部方法所引用,例如作为调用参
数传递到其他地方中
在这里插入图片描述
很显然test1方法中的user对象被返回了,这个对象的作用域范围不确定,test2方法中的user对象我们可以确定当方法结束这个对象就可以认为是无效对象了,对于这样的对象我们其实可以将其分配在栈内存里,让其在方法结束时跟随栈内存一起被回收掉

JVM对于这种情况可以通过开启逃逸分析参数(-XX:+DoEscapeAnalysis)来优化对象内存分配位置,使其通过 标量替换 优先分配在栈上(栈上分配),JDK7之后默认开启逃逸分析,如果要关闭使用参数(-XX:-DoEscapeAnalysis)

栈上分配

我们通过JVM内存分配可以知道JAVA中的对象都是在堆上进行分配,当对象没有被引用的时候,需要依靠GC进行回收内存如果对象数量较多的时候,会给GC带来较大压力,也间接影响了应用的性能。为了减少临时对象在堆内分配的数量,JVM通过 逃逸分析 确定该对象不会被外部访问(对象返回到方法之外)。如果不会逃逸可以将该对象在栈上分配内存,这样该对象所占用的内存空间就可以 随栈帧出栈而销毁,就减轻了垃圾回收的压力
在这里插入图片描述

标量替换

通过逃逸分析确定该对象不会被外部访问,并且对象可以被进一步分解时,JVM不会创建该对象,而是将该对象成员变量分解若干个被这个方法使用的成员变量所代替,这些代替的成员变量在栈帧或寄存器上分配空间,这样就不会因为没有一大块连续空间导致对象内存不够分配。
开启标量替换参数(-XX:+EliminateAllocations),JDK7之后默认开启。

标量与聚合量

标量即不可被进一步分解的量,而JAVA的基本数据类型就是标量(如:int,long等基本数据类型以及reference类型等),标量的对立就是可以被进一步分解的量,而这种量称之为聚合量。而在JAVA中对象就是可以被进一步分解的聚合量

结论:栈上分配依赖于逃逸分析和标量替换

对象在Eden区分配

大多数情况下,对象在新生代中 Eden 区分配。当 Eden 区没有足够空间进行分配时,虚拟机将发起一次Minor GC

Q6:Minor GC和Full GC 有什么不同呢?
Minor GC/Young GC:指发生新生代的的垃圾收集动作,Minor GC非常频繁,回收速度一般也比较快
Major GC/Full GC:一般会回收老年代 ,年轻代,方法区的垃圾,Major GC的速度一般会比Minor GC的慢10倍以上。

Eden与Survivor区默认8:1:1
大量的对象被分配在eden区,eden区满了后会触发minor gc,可能会有99%以上的对象成为垃圾被回收掉,剩余存活的对象会被挪到为空的那块survivor区,下一次eden区满了后又会触发minor gc,把eden区和survivor区垃圾对象回收,把剩余存活的对象一次性挪动到另外一块为空的survivor区,因为新生代的对象都是朝生夕死的,存活时间很短,所以JVM默认的8:1:1的比例是很合适的,让eden区尽量的大,survivor区够用即可,
JVM默认有这个参数-XX:+UseAdaptiveSizePolicy(默认开启),会导致这个8:1:1比例自动变化,如果不想这个比例有变化可以设置参数-XX:-UseAdaptiveSizePolicy
在这里插入图片描述
我们可以看出eden区内存几乎已经被分配完全(即使程序什么也不做,新生代也会使用至少几M内存
我们再为allocation2分配内存
在这里插入图片描述
我们发现60M的allocation1直接跑老年代去了
简单解释一下为什么会出现这种情况: 因为给allocation2分配内存的时候eden区内存几乎已经被分配完了,当Eden区没有足够空间进行分配时,虚拟机将发起一次Minor GC,GC期间虚拟机又发现allocation1无法存入Survior空间,所以只好把新生代的对象提前转移到老年代中去,老年代上的空间足够存放allocation1,所以不会出现Full GC。执行Minor GC后,后面分配的对象如果能够存在eden区的话,还是会在eden区分配内存。
在这里插入图片描述

大对象直接进入老年代

对象分配的时候一般都是往堆上的Eden区放,如果是非常大的对象,直接放到老年代,如果不是大对象,那会通过TLAB分配方法在Eden区划一块内存空间放入对象,如果TLAB分配失败了,那么直接用CAS分配方法在Eden区去分配
大对象就是需要大量连续内存空间的对象(比如:字符串数组)。
JVM参数 -XX:PretenureSizeThreshold 可以设置大对象的大小,如果对象超过设置大小会直接进入老年代,不会进入年轻代,这个参数只在 SerialParNew两个收集器下有效。
比如设置JVM参数:-XX:PretenureSizeThreshold=1000000 (单位是字节) -XX:+UseSerialGC ,再执行下上面的第一个程序会发现大对象直接进了老年代

Q7:为什么要这样呢?
为了避免为大对象分配内存时的复制操作而降低效率

长期存活的对象将进入老年代

既然虚拟机采用了分代收集的思想来管理内存,那么内存回收时就必须能识别哪些对象应放在新生代,哪些对象应放在老年代中。为了做到这一点,虚拟机给每个对象一个对象年龄(Age)计数器
如果对象在 Eden 出生并经过第一次 Minor GC 后仍然能够存活,并且能被 Survivor 容纳的话,将被移动到 Survivor空间中,并将对象年龄设为1。对象在 Survivor 中每熬过一次 MinorGC,年龄就增加1岁,当它的年龄增加到一定程度(默认为15岁,CMS收集器默认6岁,不同的垃圾收集器会略微有点不同),就会被晋升到老年代中。对象晋升到老年代的年龄阈值,
可以通过参数 -XX:MaxTenuringThreshold 来设置。

(以下是一些可能需要将-XX:MaxTenuringThreshold设置小一些的情况:
1. 对象存活时间较短:如果应用程序中大部分对象的存活时间很短,设置较小的阈值可以更快地将这些对象回收,减少对新生代的占用,提高内存利用率
2. 垃圾收集时间过长:如果垃圾收集器的停顿时间过长,可能会影响应用程序的性能。将-XX:MaxTenuringThreshold设置小一些可以更快地将对象移动到老年代,减少新生代的回收次数,从而缩短垃圾收集的停顿时间
3. 内存占用过大:如果应用程序的内存占用较大,可能导致频繁的垃圾收集。通过将-XX:MaxTenuringThreshold设置小一些,可以减少对象在新生代的存活时间,从而减少新生代的内存占用,降低垃圾收集的频率

需要注意的是,将-XX:MaxTenuringThreshold设置得过小可能会导致对象过早进入老年代,增加老年代的内存占用和垃圾收集的负担。因此,在设置该参数时需要根据具体的应用程序特点和性能需求进行调优)

对象动态年龄判断

当前放对象的Survivor区域里(其中一块区域,放对象的那块s区),一批对象总大小大于这块Survivor区域内存大小的50%(-XX:TargetSurvivorRatio可以指定),那么此时大于等于这批对象年龄最大值的对象,就可以直接进入老年代了。
例如Survivor区域里现在有一批对象,年龄1+年龄2+年龄n的多个年龄对象总和超过了Survivor区域的50%,此时就会把年龄n(含)以上的对象都放入老年代。这个规则其实是希望那些可能是长期存活的对象,尽早进入老年代。对象动态年龄判断机制一般是在 minor gc之后触发的

老年代空间分配担保机制

年轻代每次minor gc之前JVM都会计算下老年代剩余可用空间
如果这个可用空间小于年轻代里现有的所有对象大小之和(包括垃圾对象)(大于的话就直接minor GC
就会看一个“-XX:-HandlePromotionFailure”(jdk1.8默认就设置了)的参数是否设置了
如果有这个参数,就会看看老年代的可用内存大小,是否大于之前每一次minor gc后进入老年代的对象的平均大小。(大于就直接minorGC
如果上一步结果是小于或者之前说的参数没有设置,那么就会触发一次Full gc,对老年代和年轻代一起回收一次垃圾;
如果回收完还是没有足够空间存放新的对象就会发生"OOM"
当然,如果minor gc之后剩余存活的需要挪动到老年代的对象大小还是大于老年代可用空间,那么也会触发full gc,fullgc完之后如果还是没有空间放minor gc之后的存活对象,则也会发生“OOM”

这个担保参数是主要是干嘛的呢,先判断要存入老年代的对象是否大于老年代剩余空间够的话就直接minorGC干掉一些垃圾对象,对象进入老年代),如果不够了,那么通过这个参数,按照之前每次进入老年代的对象的大小取一个平均值再去和老年代剩余空间比较大小(够就minorGC干掉一些垃圾对象,对象进入老年代,就不需要fullGC),如果还是不够那就直接full GC
说白了 这个参数就是为了担保不触发fullGC如果大概率会做fullGC,那么先做一次full GC,之后再minor GC,这次minorGC耗费时间会比较短;假如直接minorGC会耗费时间久一些,然后还得触发full GC
在这里插入图片描述

四、对象内存回收机制详解

引用计数法

给对象中添加一个引用计数器,每当有一个地方引用它,计数器就加1;当引用失效,计数器就减1;任何时候计数器为0的对象就是不可能再被使用的。

这个方法实现简单,效率高,但是目前主流的虚拟机中并没有选择这个算法来管理内存,其最主要的原因是它很难解决对象之间相互循环引用的问题。

所谓对象之间的相互引用问题,如下面代码所示:除了对象objA 和 objB 相互引用着对
方之外,这两个对象之间再无任何引用。但是他们因为互相引用对方,导致它们的引用计数器都不为0,于是引用计数算法无法通知 GC 回收器回收他们。
在这里插入图片描述
这算一种 内存泄漏

可达性分析算法

将“GC Roots” 对象作为起点,从这些节点开始向下搜索引用的对象,找到的对象都标记为 非垃圾对象,其余未标记的对象都是垃圾对象

GC Roots根节点:线程栈的本地变量、静态变量、本地方法栈的变量等等
在这里插入图片描述

常见引用类型

java的引用类型一般分为四种:强引用软引用、弱引用、虚引用

强引用:普通的变量引用
在这里插入图片描述
软引用:将对象用SoftReference软引用类型的对象包裹,正常情况不会被回收,但是GC做完后发现释放不出空间存放新的对象,则会把这些软引用的对象回收掉软引用可用来实现内存敏感的高速缓存

软引用在实际中有重要的应用,例如浏览器的后退按钮。按后退时,这个后退时显示的网页内容是重新进行请求还是从缓存中取出呢?这就要看具体的实现策略了。
(1)如果一个网页在浏览结束时就进行内容的回收,则按后退查看前面浏览过的页面时,需要重新构建
(2)如果将浏览过的网页存储到内存中会造成内存的大量浪费,甚至会造成内存溢出
在这里插入图片描述
弱引用:将对象用WeakReference软引用类型的对象包裹,弱引用跟没引用差不多,GC会直接回收掉,很少用
在这里插入图片描述
虚引用:虚引用也称为幽灵引用或者幻影引用,它是最弱的一种引用关系,几乎不用

finalize()方法最终判定对象是否存活

即使在可达性分析算法中不可达的对象,也并非是“非死不可”的,这时候它们暂时处于“缓刑”阶段,要真正宣告一个对象死亡,至少要经历再次标记过程。
标记的前提是对象在进行可达性分析后发现没有与GC Roots相连接的引用链

  1. 第一次标记并进行一次筛选
    筛选的条件是此对象是否有必要执行finalize()方法。
    当对象没有覆盖finalize方法,对象将直接被回收。
  2. 第二次标记
    如果这个对象覆盖了finalize方法,finalize方法是对象脱逃死亡命运的最后一次机会,如果对象要在finalize()中成功拯救自己,只要重新与引用链上的任何的一个对象建立关联即可,譬如把自己赋值给某个类变量或对象的成员变量,那在第二次标记时它将移除出“即将回收”的集合。如果对象这时候还没逃脱,那基本上它就真的被回收了。
    注意:一个对象的finalize()方法只会被执行一次,也就是说通过调用finalize方法自我救命的机会就一次。
    在这里插入图片描述

如何判断一个类是无用的类

方法区主要回收的是无用的类,那么如何判断一个类是无用的类的呢?
类需要同时满足下面3个条件才能算是 “无用的类” :

  1. 该类所有的实例都已经被回收,也就是 Java 堆中不存在该类的任何实例。
  2. 加载该类的 ClassLoader 已经被回收(基本上只有自定义类加载器)。
  3. 该类对应的 java.lang.Class 对象没有在任何地方被引用,无法在任何地方通过反射访问该类的方法。

所以一般回收完之后,元空间不会回收掉多少,条件比较苛刻

五、日均百万级订单交易系统JVM参数设置实例

在这里插入图片描述
上述案例,大促时候每秒的大概有1000多订单,假设我们有三台机器(4核8G),每天机器分配大概300多单每秒;
一般同学可能会根据物理机内存大小来这么设置(操作系统分配3G,JVM分配5G(堆3G,方法区512M,栈1M)
应该根据业务并发压力去估算一个内存模型,我们暂时不考虑逃逸分析(出现的很少),默认对象都分配在堆上,那么每秒300个订单对象到堆里去,假设一个订单1kb(需要根据订单对象字段的多少来估算),每秒就是300kb的对象分配到Eden区;
当然了下单操作不会仅仅只有订单对象,还有库存,优惠券,积分等业务对象,我们放大20倍,那么也就是每秒6M的对象放到Eden区;
可能同时还有其他操作,订单查询等,我们再放大10倍,那么也就是每秒60M的对象放入Eden区,而且1秒后会成为垃圾对象
如果是按照物理机内存去设置,那么线上会频繁FullGC因为堆设置为3G,那么老年代默认占2/3,也就就是2G,那么Eden区默认800M,s0100M,s1100M(8:1:1);意味着大概13-14s,Eden区会放满,触发minor GC,会出现这么个情况,前14s放满了,触发了STW机制,那么15s的那60M对象还被GCRoot引用着,无法被回收,会被复制到survior区;此时会触发一个机制(对象动态年龄判断),这60M会直接进去老年代;也就是说每过14s会有60M对象复制到老年代,大概几分钟就放满了,那么就会触发full GC;那就有问题了,fullGC 我们需要优化到几个小时,甚至几天几周才触发一次。
在这里插入图片描述
怎么做呢,只需要把年轻代放大一些设置为2G(Eden1.6G,s0200M,s1200M),老年代为1G
我们再看,首先minor GC会大概延迟到25秒60M的对象放到survior区不会触发对象动态年龄判断机制(不足50%),就不会进入老年代;避免了没必要的full GC。
在这里插入图片描述

  • 2
    点赞
  • 0
    收藏
    觉得还不错? 一键收藏
  • 0
    评论
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值