JVM对象创建与内存分配机制

目录

1.对象创建

1.1.类加载检查

1.2.分配内存

1.2.1划分内存的方法

1.2.2解决并发分配的问题

1.3初始化

1.4设置对象头

1.5执行方法

1.6补充:指针压缩

2.内存分配

2.1对象内存分配流程

2.2对象栈上分配内存

2.2.1对象逃逸分析

2.2.1标量替换

2.3对象在Eden区分配

2.4大对象直接进入老年代

2.5长期存活的对象进入老年代

2.6对象动态年龄判断

2.7老年代空间分配担保机制(老年代提前full GC)

3.对象内存回收

3.1引用计数法

3.2可达性分析

3.3常见引用类型

3.4finalize()方法

3.5无用的类(回收元空间中的类元信息)


1.对象创建

创建对象的大体流程如下:

1.1.类加载检查

虚拟机遇到一条new指令时,首先去检查这个指令的参数是否能在常量池中定位到一个类的符号引用,并且检查这个符号引用代表的类是否已被加载、解析和初始化过。如果没有,那必须先执行相应的类加载过程。

new指令对应到语言层面是指new关键词、对象克隆、对象序列化等。

1.2.分配内存

虚拟机将为新生对象分配内存。对象所需内存的大小在类加载完成后便可完全确定,为对象分配空间的任务等同于把一块确定大小的内存从Java堆上划分出来。

1.2.1划分内存的方法

1.指针碰撞(Bump the Pointer),默认使用这个

如果Java堆中内存是绝对规整的,所有用过的内存都放在一边,空闲的内存都放在另一边,中间放着一个指针作为分界点的指示器,那所分配内存就静静是把那个指针向空闲空间那边挪动一段与对象大小相等的距离。

2.空闲列表(Free list)

如果Java堆中的内存并不是规整的,已使用的内存和空闲的内存相互交错,那就没有办法简单地进行指针碰撞了,虚拟机就必须维护一个列表,记录哪些内存块是可用的,在分配的时候从列表中找到一块足够大的空间划分给对象实例, 并更新列表上的记录。

1.2.2解决并发分配的问题

1.CAS(compare And swap)

虚拟机采用CAS配上失败重试的方法保证更新操作的原子性来对分配内存空间的动作进行同步处理。

2.本地线程分配缓存(Thread Local Allocation Buffer,TLAB)

把内存分配的动作按照线程划分在不同的空间中进行,即每个线程在Java堆中预先分配一小块内存。(默认开启)

TLAB补充:

2.1为了减少对堆内存的同步访问,JVM引入了TLAB。TLAB是每个线程私有的内存区域,用于分配小型对象。当线程需要分配对象时,它会首先在TLAB上进行,而不需要进行同步操作。只有当TLAB用尽或者需要分配大型对象时,线程才会直接在堆上进行分配,这时可能需要进行同步。
2.2TLAB的工作原理:

  • TLAB 实际上是一个线程私有的内存缓冲区,用于存储新创建的对象。
  • 当一个线程需要分配一个对象时,它首先会检查自己的 TLAB 是否有足够的空间进行分配。
  • 如果有足够的空间,那么就直接在 TLAB 中分配对象,并更新 TLAB 的指针。
  • 如果没有足够的空间,那么就从堆内存中申请一块新的内存空间,并将其划分为新的 TLAB。

在JVM中,对象的分配主要发生在堆内存的新生代中。新生代又分为Eden区和两个Survivor区(S0和S1),它们共同承担着新对象的分配和垃圾回收任务。

而TLAB则是Eden区的一部分,每个线程都有自己的TLAB,它们互不干扰,避免了线程间竞争,独立进行内存分配,从而提高了分配效率。

1.3初始化

内存分配完后,虚拟机需要将分配到的内存空间都初始化为零值(不包括对象头), 如果使用TLAB,这一工作过程也 可以提前至TLAB分配时进行。这一步操作保证了对象的实例字段在Java代码中可以不赋初始值就直接使用,程序能访问到这些字段的数据类型所对应的零值。

1.4设置对象头

在HotSpot虚拟机中,对象在内存中存储的布局可以分为3块区域:对象头(Header)、 实例数据(Instance Data)和对齐填充(Padding)。

HotSpot虚拟机的对象头包括两部分信息,第一部分用于存储对象自身的运行时数据, 如哈希码(HashCode) 、GC分代年龄、锁状态标志、线程持有的锁、偏向线程ID、偏向时间戳等。对象头的另外一部分是类型指针,即对象指向它的类元数据的指针,虚拟机通过这个指针来确定这个对象是哪个类的实例。如果是数组对象,那么还存在4字节的数组长度标识。

1.5执行<init>方法

执行<init>方法,即对象按照程序员的意愿进行初始化。对应到语言层面上讲,就是为属性赋值(注意,这与上面的赋零值不同,这是由程序员赋的值),和执行构造方法。

1.6补充:指针压缩

在jvm中,32位地址最大支持4G内存(2的32次方),可以通过对对象指针的压缩编码、解码方式进行优化,使得jvm只用32位地址就可以支持更大的内存配置(小于等于32G)

当堆内存小于4G时,不需要启用指针压缩,jvm会直接去除高32位地址,即使用低虚拟地址空间

当堆内存大于32G时,压缩指针会失效,会强制使用64位(即8字节)来对java对象寻址,这就会出现1的问题,所以堆内存不要大于32G为好。

如果不使用指针压缩,使用较大指针在主内存和缓存之间移动数据,占用较大宽带,同时GC也会承受较大压力。 

2.内存分配

2.1对象内存分配流程

2.2对象栈上分配内存

栈上分配依赖于逃逸分析标量替换

为了减少临时对象在堆内分配的数量,JVM通过逃逸分析确定该对象不会被外部访问。如果不会逃逸可以将该对象在栈上分配内存,这样该对象所占用的内存空间就可以随栈帧出栈而销毁,就减轻了垃圾回收的压力。

2.2.1对象逃逸分析

就是分析对象动态作用域,当一个对象在方法中被定义后,它可能被外部方法所引用,例如作为调用参数传递到其他地方中。JDK7之后默认开启逃逸分析

2.2.1标量替换

JVM通过标量替换优先将非逃逸对象分配在栈上(栈上分配)。

标量替换:通过逃逸分析确定该对象不会被外部访问,并且对象可以被进一步分解时,JVM不会创建该对象,而是将该对象成员变量分解若干个被这个方法使用的成员变量所代替,这些代替的成员变量在栈帧或寄存器上分配空间,这样就 不会因为没有一大块连续空间导致对象内存不够分配。(JDK7之后默认开启标量替换)

标量与聚合量:标量即不可被进一步分解的量,而JAVA的基本数据类型就是标量(如:int,long等基本数据类型以及 reference类型等),标量的对立就是可以被进一步分解的量,而这种量称之为聚合量。而在JAVA中对象就是可以被进一步分解的聚合量。

2.3对象在Eden区分配

2.4大对象直接进入老年代

大对象就是需要大量连续内存空间的对象(比如:字符串、数组)。

目的是:为了避免为大对象分配内存时的复制操作而降低效率。

2.5长期存活的对象进入老年代

既然虚拟机采用了分代收集的思想来管理内存,那么内存回收时就必须能识别哪些对象应放在新生代,哪些对象应放在老年代中。为了做到这一点,虚拟机给每个对象一个对象年龄(Age)计数器。

如果对象在 Eden 出生并经过第一次 Minor GC 后仍然能够存活,并且能被 Survivor 容纳的话,将被移动到Survivor 空间中,并将对象年龄设为1。对象在 Survivor 中每熬过一次 MinorGC,年龄就增加1岁,当它的年龄增加到一定程度 (默认为15岁,CMS收集器默认6岁,不同的垃圾收集器会略微有点不同),就会被晋升到老年代中。

2.6对象动态年龄判断

当前放对象的Survivor区域里,一批对象的总大小大于这块Survivor区域内存大小的 50%

(-XX: TargetSurvivorRatio可以指定),那么此时大于等于这批对象年龄最大值的对象,就可以直接进入老年代了, 例如Survivor区域里现在有一批对象,年龄1+年龄2+年龄n的多个年龄对象总和超过了Survivor区域的50%,此时就会把年龄n(含)以上的对象都放入老年代。这个规则其实是希望那些可能是长期存活的对象,尽早进入老年代。

对象动态年龄判断机制一般是在minor gc之后触发的。

2.7老年代空间分配担保机制(老年代提前full GC)

年轻代每次minor gc之前JVM都会计算下老年代剩余可用空间,如果这个可用空间小于年轻代里现有的所有对象大小之和(包括垃圾对象) ,就会看一个参数“-XX:-HandlePromotionFailure”(jdk1.8默认就设置了)是否设置了;如果有这个参数,就会看看老年代的可用内存大小,是否大于之前每一次minor gc后进入老年代的对象的平均大小。

如果上一步结果是小于或者之前说的参数没有设置,那么就会触发一次Full gc,对老年代和年轻代一起回收一次垃圾, 如果回收完还是没有足够空间存放新的对象就会发生"OOM"

当然,如果minor gc之后剩余存活的需要挪动到老年代的对象大小还是大于老年代可用空间,那么也会触发full gc,full gc完之后如果还是没有空间放minor gc之后的存活对象,则也会发生“OOM”

3.对象内存回收

堆中几乎放着所有的对象实例,对堆垃圾回收前的第一步就是要判断哪些对象已经死亡(即不能再被任何途径使用的对象)。有两种方法:1.引用计数法;2.可达性分析

3.1引用计数法

给对象中添加一个引用计数器,每当有一个地方引用它,计数器就加1;当引用失效,计数器就减1;任何时候计数器为0的对象就是不可能再被使用的。

缺点:它很难解决对象之间相互循环引用的问题。

3.2可达性分析

将“GC Roots” 对象作为起点,从这些节点开始向下搜索引用的对象,找到的对象都标记为非垃圾对象,其余未标记的对象都是垃圾对象。

GC Roots根节点:线程栈的本地变量、静态变量、本地方法栈的变量等等。

3.3常见引用类型

java的引用类型一般分为四种:强引用、软引用、弱引用、虚引用

1.强引用:普通的变量引用;

2.软引用:将对象用SoftReference软引用类型的对象包裹,正常情况不会被回收,但是GC做完后发现释放不出空间存放新的对象,则会把这些软引用的对象回收掉。软引用可用来实现内存敏感的高速缓存。例如浏览器的后退按钮。

3.弱引用:将对象用WeakReference软引用类型的对象包裹,弱引用跟没引用差不多,GC会直接回收掉,很少用。

弱引用可以和一个引用队列(ReferenceQueue)联合使用,如果弱引用所引用的对象被垃圾回收,Java虚拟机就会把这个弱引用加入到与之关联的引用队列中。

4.虚引用:虚引用也称为幽灵引用或者幻影引用,它是最弱的一种引用关系,几乎不用。

虚引用必须和引用队列 (ReferenceQueue)联合使用。当垃圾回收器准备回收一个对象时,如果发现它还有虚引用,就会在回收对象的内存之前,把这个虚引用加入到与之关联的引用队列中。

  • 程序可以通过判断引用队列中是否存在该对象的虚引用,来了解这个对象是否将要被回收。可以用来作为GC回收Object的标志。
  • 可以用虚引用来管理堆外内存。(通过引用队列,将堆外内存释放)

3.4finalize()方法

即使在可达性分析算法中不可达的对象,也并非是“非死不可”的,这时候它们暂时处于“缓刑”阶段,要真正宣告一个对象死亡,至少要经历再次标记过程。当对象没有覆盖finalize方法,对象将直接被回收。如果对象重写了这个方法,那么它还有自救的可能。

一个对象的finalize()方法只会被执行一次,也就是说通过调用finalize方法自我救命的机会就一次。

3.5无用的类(回收元空间中的类元信息)

需要同时满足以下3个条件:

  1. 该类所有的实例都已经被回收,也就是 Java 堆中不存在该类的任何实例。
  2. 加载该类的ClassLoader已经被回收。 (自定义类加载器可能会被回收,app、ext类加载器一般不会被回收)
  3. 该类对应的java.lang.Class对象没有在任何地方被引用,无法在任何地方通过反射访问该类的方法。
  • 9
    点赞
  • 8
    收藏
    觉得还不错? 一键收藏
  • 0
    评论
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值