一篇文章彻底搞懂JVM对象的创建和内存分配机制(深度剖析)


前言


一、对象的创建

说到对象的创建,首先让我们看看java中提供的集中对象创建方式;

Header解释
使用new关键字调用了构造函数
使用Class的newInstance方法调用了构造函数
使用Constructor类的newinstance方法调用了构造函数
使用clone没有调用构造函数
使用反序列化没有调用构造函数

对象创建的主要流程

在这里插入图片描述

1、类加载检查

虚拟机遇到一条new指令,先检查常量池是否已经加载相应的类,如果没有,必须先执行相应的类加载。

2、分配内存

在类加载通过后,接下来虚拟机将为新生对象分配内存。对象所需内存的大小在类加载完成后便可完全确认,为对象分配空间的任务等同把一块确定大小的内存从java碓中划分出来。

3、初始化零值

内存分配完后,虚拟机需要将分配到的内存空间都初始化为零值(不包括对象头)。如果使用TLAB,这一工作过程也可以提前至TLAB分配时进行。这一步操作保证了对象的实例字段在java代码中可以不赋初始值就可以直接使用,程序能访问这些字段的数据类型所对应的零值(如基本类型int long boolean等);

4、设置对象头

初始化零值之后,虚拟机要怼对象进行必要的设置,例如这个对象是哪个类的实例,如何才能找到类的元数据信息、对象的哈希吗、对象的GC分代年龄等信息。这些信息都存放在对象的对象头Object Header之中。

在HosSpot虚拟机中,对象在内存中的存储的布局可以分为3块区域:对象头、实例数据、对象填充

4.1、对象头包括3部分信息;

第一部分:储存对象自身运行时的数据,如哈希吗、GC分代年龄、锁状态标识、线程持有锁等;
第二部分:是类型指针,即对象指向它的类元数据的指针,虚拟机通过这个指针来确定这个对象是哪个类的实例。
第三部分:数组长度,4字节,只有数组对象才有。

4.2 、实例数据
4.3、对象填充

对于大部分处理器,对象以8个字节的整数倍来对其,填充都是最高效的存取方式。
在这里插入图片描述

在这里插入图片描述

5、执行init方法

执行init方法,即按照程序员的意愿进行初始化。对应到语言层面就是为属性赋值(注意,这和前面讲的赋零值不同,这是由程序员赋的值),和执行构造方法。


二、对象内存分配

1、划分内存的二种方式

指针碰撞(默认采用):
如果java堆中内存是绝对规整的,所有用过的内存放一边,空闲的内存放另一边,中间放着一个指针作为分界点的指示器,那所分配 内存就仅仅是把那个指针向空闲空间那边挪动一段与对象大小相等的距离

空闲列表:
如果Java堆中的内存并不是规整的,已使用的内存和空 闲的内存相互交错,那就没有办法简单地进行指针碰撞了,虚拟机就必须维护一个列表记录上哪些内存块是可用的,在分配的时候从列表中找到一块足够大的空间划分给对象实例, 并更新列表上的记录

选择哪种分配方式是由java堆是否规整来决定的,而java堆是否规整又是由所采用的垃圾收集器是否带有压缩整理功能决定的。

2、分配内存时的并发问题

对象的创建在虚拟机是一种非常频繁的行为,哪怕只是修改一个指针所指向的位置,在并发环境下也是不安全的。并发情况下,可能出现正在给对象A分配内存,指针还没来得及修改,对象B又同时使用了原来的指针来分配内存的情况。

解决此问题也有2种解决方案
CAS(同步处理):
对分配内存空间的动作进行同步处理(采用CAS+失败重试来保障更新操作的原子性)

本地线程分配缓存(TLAB):
把内存分配的动作按照线程划分在不同的空间之中进行,即每个线程在java堆中预先分配一小块内存,称为本地线程分配缓冲。
哪个线程要分配内存,就在哪个线程的TLAB上分配。只有TLAB用完并分配新的TLAB时。
通过 -XX:+/-UserTLAB 参数来设定虚拟机是否使用TLAB,以及 -XX:TLABSize 设置TLAB的大小;

3、对象内存分配流程图

在这里插入图片描述

3.1、对象栈上分配

java对象一般都是在堆上进行分配,当对象没有被引用的时候,需要依靠GC进行回收内存,如果对象数量较多,会给GC带来较大的压力,也间接影响了应用的性能。
为了减少临时对象在堆内分配的数量,JVM通过逃逸分析确定该对象不会被外部访问时,如果不会逃逸就可以将对象在栈上进行分配内存,这样该对象所占用的内存空间就可以随栈帧出栈而销毁,就减轻了垃圾回收的压力。

3.2、什么是对象逃逸分析?

就是分析对象动态作用域,当一个对象在方法中被定义后,它可能被外部方法所引用,例如作为调用参数传递到其他地方中;

逃逸分析看下面这个案例

public User test1() {
   User user = new User();
   user.setId(1);
   user.setName("zhuge");
   //TODO 保存到数据库
   return user;
}

public void test2() {
   User user = new User();
   user.setId(1);
   user.setName("zhuge");
   //TODO 保存到数据库
}

很显然test1方法中的user对象被返回了,这个对象的作用域不确定;
test2中的user对象我们可以确定当方法结束这个对象就可以认定是无效对象了,对于这样的对象我们其实可以将其分配在栈内存里,让其方法在结束时随着栈内存一起被回收掉。

JVM对于这种情况可以通过开启逃逸分析参数(-XX:+DoEscapeAnalysis)来优化对象内存分配位置,使其通过标量替换优先分配在栈上(栈上分配),JDK7之后默认开启逃逸分析,如果要关闭使用参数(-XX:-DoEscapeAnalysis)

3.3、标量替换:

通过逃逸分析确定对象不会被外部访问时,对象可以被进一步分解时,JVM不会创建该对象,而是将对象成员变量分解成若干个被这个方法使用的成员变量所替代,这些替代的成员变量在栈帧或者CPU寄存器上分配空间,这样就不会因为没有一大块连续的空间导致对象内存不够分配。
标量即不可被进一步分解的量,即java的基本类型就是标量

3.4、标量与聚合量:

标量的对立就是可以被进一步分解的量,而这种量就被称之为聚合量,而在java中对象就是可以被进一步分解的聚合量。

看一下栈上分配案例代码
先说结论:栈上分配依赖于逃逸分析和标量替换

/**
 * 栈上分配,标量替换
 * 代码调用了1亿次alloc(),如果是分配到堆上,大概需要1GB以上堆空间,如果堆空间小于该值,必然会触发GC。
 * 
 * 使用如下参数不会发生GC
 * -Xmx15m -Xms15m -XX:+DoEscapeAnalysis -XX:+PrintGC -XX:+EliminateAllocations
 * 使用如下参数都会发生大量GC
 * -Xmx15m -Xms15m -XX:-DoEscapeAnalysis -XX:+PrintGC -XX:+EliminateAllocations
 * -Xmx15m -Xms15m -XX:+DoEscapeAnalysis -XX:+PrintGC -XX:-EliminateAllocations
 */
public class AllotOnStack {

    public static void main(String[] args) {
        long start = System.currentTimeMillis();
        for (int i = 0; i < 100000000; i++) {
            alloc();
        }
        long end = System.currentTimeMillis();
        System.out.println(end - start);
    }

    private static void alloc() {
        User user = new User();
        user.setId(1);
        user.setName("zhuge");
    }
}

3.5、对象在Eden区分配

大多数情况,对象都在新生代Eden区分配。当Eden区没有足够空间进行分配时,虚拟机将发起minor GC。

这里引用一段代码案例来实际测试一下

3.5.1、先了解一下Minor GC和Full GC有什么不同?

Minor GC/Young GC:指发生在新生代的垃圾回收动作,Minor GC非常频繁,回收速度y-iban也比较快。
Full GC: 一般回收老年代,年轻代、方法区的垃圾,Full GC的速度一遍会比Minor GC慢十倍以上。

3.5.2、Eden(新生代区)与Survivor(幸存者区)默认是以8:1:1的比例分配

大量的对象被分配在Eden区,Eden区满了后会触发minor GC,可能会有99%以上的对象成为垃圾被回收掉,
剩余存活的对象会被挪到空的那个幸存者区,下一次Eden区再次满了后又会触发minor GC,连同堆和非空的幸存者区一起进行垃圾回收,然后再次把存活的对象,挪到另外一个空的幸存者区。

JVM优化建议
因为新生代区的对象大多都属于是朝生夕死的对象,存活时间很短,所以为了避免频繁的Full GC,尽可能让Eden区尽量大,幸存者区够用就行;
生产实际情况,需进行多次调优才能找到合适的参数设置;

JVM设置堆的新生代区和幸存者区的比例
JVM默认有这个参数 -XX:+UseAdaptiveSizePolicy (默认开启),会导致这个8:1:1比例自动变化,如果不想这个比例有变化可以设置参数-XX:-UseAdaptiveSizePolicy

3.6、通过代码案例来了解堆空间的变化

我们可以看出eden区内存几乎已经被占满100%了(即使程序什么也不做,新生代也会使用至少几M内存)。

//添加运行JVM参数: -XX:+PrintGCDetails
public class GCTest {
   public static void main(String[] args) throws InterruptedException {
      byte[] allocation1, allocation2;
      allocation1 = new byte[60000*1024];
   }
}

运行结果:
Heap
 PSYoungGen      total 76288K, used 65536K [0x000000076b400000, 0x0000000770900000, 0x00000007c0000000)
  eden space 65536K, 100% used [0x000000076b400000,0x000000076f400000,0x000000076f400000)
  from space 10752K, 0% used [0x000000076fe80000,0x000000076fe80000,0x0000000770900000)
  to   space 10752K, 0% used [0x000000076f400000,0x000000076f400000,0x000000076fe80000)
 ParOldGen       total 175104K, used 0K [0x00000006c1c00000, 0x00000006cc700000, 0x000000076b400000)
  object space 175104K, 0% used [0x00000006c1c00000,0x00000006c1c00000,0x00000006cc700000)
 Metaspace       used 3342K, capacity 4496K, committed 4864K, reserved 1056768K
  class space    used 361K, capacity 388K, committed 512K, reserved 1048576K

假如我们再为allocation2分配内存会出现什么情况呢?

//添加运行JVM参数: -XX:+PrintGCDetails

//添加运行JVM参数: -XX:+PrintGCDetails
public class GCTest {
   public static void main(String[] args) throws InterruptedException {
      byte[] allocation1, allocation2;
      allocation1 = new byte[60000*1024];

      allocation2 = new byte[8000*1024];
   }
}

运行结果:
[GC (Allocation Failure) [PSYoungGen: 65253K->936K(76288K)] 65253K->60944K(251392K), 0.0279083 secs] [Times: user=0.13 sys=0.02, real=0.03 secs] 
Heap
 PSYoungGen      total 76288K, used 9591K [0x000000076b400000, 0x0000000774900000, 0x00000007c0000000)
  eden space 65536K, 13% used [0x000000076b400000,0x000000076bc73ef8,0x000000076f400000)
  from space 10752K, 8% used [0x000000076f400000,0x000000076f4ea020,0x000000076fe80000)
  to   space 10752K, 0% used [0x0000000773e80000,0x0000000773e80000,0x0000000774900000)
 ParOldGen       total 175104K, used 60008K [0x00000006c1c00000, 0x00000006cc700000, 0x000000076b400000)
  object space 175104K, 34% used [0x00000006c1c00000,0x00000006c569a010,0x00000006cc700000)
 Metaspace       used 3342K, capacity 4496K, committed 4864K, reserved 1056768K
  class space    used 361K, capacity 388K, committed 512K, reserved 1048576K

简单解释一下为什么会出现这种情况:
因为给allocation2分配内存的时候eden区内存几乎已经被分配完了,我们刚刚讲了当Eden区没有足够空间进行分配时,虚拟机将发起一次Minor GC,GC期间虚拟机又发现allocation1(因为他的大小比幸存者区还要大)无法存入Survior空间,所以只好把新生代的对象提前转移到老年代中去,老年代上的空间足够存放allocation1,所以不会出现Full GC。执行Minor GC后,后面分配的对象如果能够存在eden区的话,还是会在eden区分配内存。

可以执行如下代码验证:

public class GCTest {
   public static void main(String[] args) throws InterruptedException {
      byte[] allocation1, allocation2, allocation3, allocation4, allocation5, allocation6;
      allocation1 = new byte[60000*1024];

      allocation2 = new byte[8000*1024];

      allocation3 = new byte[1000*1024];
      allocation4 = new byte[1000*1024];
     allocation5 = new byte[1000*1024];
     allocation6 = new byte[1000*1024];
   }
}

运行结果:
[GC (Allocation Failure) [PSYoungGen: 65253K->952K(76288K)] 65253K->60960K(251392K), 0.0311467 secs] [Times: user=0.08 sys=0.02, real=0.03 secs] 
Heap
 PSYoungGen      total 76288K, used 13878K [0x000000076b400000, 0x0000000774900000, 0x00000007c0000000)
  eden space 65536K, 19% used [0x000000076b400000,0x000000076c09fb68,0x000000076f400000)
  from space 10752K, 8% used [0x000000076f400000,0x000000076f4ee030,0x000000076fe80000)
  to   space 10752K, 0% used [0x0000000773e80000,0x0000000773e80000,0x0000000774900000)
 ParOldGen       total 175104K, used 60008K [0x00000006c1c00000, 0x00000006cc700000, 0x000000076b400000)
  object space 175104K, 34% used [0x00000006c1c00000,0x00000006c569a010,0x00000006cc700000)
 Metaspace       used 3343K, capacity 4496K, committed 4864K, reserved 1056768K
  class space    used 361K, capacity 388K, committed 512K, reserved 1048576K

3.7、老年代区分配

在这里插入图片描述

3.7.1、大对象直接进入老年代

大对象就是需要大量连续内存空间的对象(比如:字符串、数组)。
JVM参数 -XX:PretenureSizeThreshold 可以设置大对象的大小,如果对象超过设置大小会直接进入老年代,不会进入年轻代,这个参数只在 Serial 和ParNew两个收集器下有效。

比如设置JVM参数:-XX:PretenureSizeThreshold=1000000 (单位是字节) -XX:+UseSerialGC ,再执行下上面的第一个程序会发现大对象直接进了老年代

为什么要这样呢?
为了避免为大对象分配内存时的复制操作而降低效率。


3.7.2、长期存活的对象将进入老年代

既然虚拟机采用了分代收集的思想来管理内存,那么内存回收时就必须能识别哪些对象应放在新生代,哪些对象应放在老年代中。为了做到这一点,虚拟机给每个对象一个对象年龄(Age)计数器

如果对象在 Eden 出生并经过第一次 Minor GC 后仍然能够存活,并且能被 Survivor 容纳的话,将被移动到 Survivor 空间中,并将对象年龄设为1。对象在 Survivor 中每熬过一次 MinorGC,年龄就增加1岁,当它的年龄增加到一定程度(默认为15岁,CMS收集器默认6岁,不同的垃圾收集器会略微有点不同),就会被晋升到老年代中。对象晋升到老年代的年龄阈值,
可以通过参数 -XX:MaxTenuringThreshold 来设置。


3.7.3、对象动态年龄判断

当前放对象的Survivor区域里(其中一块区域,放对象的那块s区),一批对象的总大小大于这块Survivor区域内存大小的50%(-XX:TargetSurvivorRatio可以指定),那么此时大于等于这批对象年龄最大值的对象,就可以直接进入老年代了。

例如Survivor区域里现在有一批对象,年龄1+年龄2+年龄n的多个年龄对象总和超过了Survivor区域的50%,此时就会把年龄n(含)以上的对象都放入老年代。这个规则其实是希望那些可能是长期存活的对象,尽早进入老年代。对象动态年龄判断机制一般是在minor gc之后触发的。


3.7.4、老年代空间分配担保机制

年轻代每次minor gc之前JVM都会计算下老年代剩余可用空间
1、如果这个可用空间小于年轻代里现有的所有对象大小之和(包括垃圾对象),就会看一个“-XX:-HandlePromotionFailure”(jdk1.8默认就设置了)的参数是否设置了,
2、如果没有配置这个参数,并且小于则直接minor GC。
3、如果有这个参数,就会看看老年代的可用内存大小,是否大于之前每一次minor gc后进入老年代的对象的平均大小
4、如果上一步结果是小于或者之前说的参数没有设置,那么就会触发一次Full gc,对老年代和年轻代一起回收一次垃圾,如果回收完还是没有足够空间存放新的对象就会发生"OOM"。
5、当然,如果minor gc之后剩余存活的需要挪动到老年代的对象大小还是大于老年代可用空间,那么也会触发full gc,full gc完之后如果还是没有空间放minor gc之后的存活对象,则也会发生“OOM”
在这里插入图片描述


三、对象内存回收

堆中几乎放着所有的对象实例,对堆垃圾回收前的第一步就是要判断哪些对象已经死亡(即不能再被任何途径使用的对象)。

1、引用计数器

实现方式
给对象添加一个引用计数器,每当有一个地方引用它,计数器就加一,
当引用失效,计数器就减一,
任何时候计数器为0的对象就是不可能再被使用的。

这种方式实现简单,效率也高、但是目前主流的虚拟机中并没有选择这种算法,其主要原因是因为它很难解决对象之间相互循环引用的问题。

所谓的对象之间相互引用问题,可以参考下面代码来了解;
除了对象objA 和 objB 相互引用着对方之外,这两个对象之间再无任何引用。但是他们因为互相引用对方,导致它们的引用计数器都不为0,于是引用计数算法无法通知 GC 回收器回收他们。

public class ReferenceCountingGc {
   Object instance = null;

   public static void main(String[] args) {
      ReferenceCountingGc objA = new ReferenceCountingGc();
      ReferenceCountingGc objB = new ReferenceCountingGc();
      objA.instance = objB;
      objB.instance = objA;
      objA = null;
      objB = null;
   }
}

2、可达性分析算法

将“GC Roots” 对象作为起点,从这些节点开始向下搜索引用的对象,找到的对象都标记为非垃圾对象,其余未标记的对象都是垃圾对象
GC Roots根节点线程栈的本地变量、静态变量、本地方法栈的变量等等
在这里插入图片描述


3、如何判断一个类是否是无用的类

类需要同时满足下面3个条件才能算是 “无用的类”
该类所有的对象实例都已经被回收,也就是 Java 堆中不存在该类的任何实例。
加载该类的 ClassLoader 已经被回收
该类对应的 java.lang.Class 对象没有在任何地方被引用,无法在任何地方通过反射访问该类的方法。


4、finalize()方法

finalize()方法最终判定对象是否存活
即使在可达性分析算法中不可达的对象,也并非是“非死不可”的,这时候它们暂时处于“缓刑”阶段,要真正宣告一个对象死亡,至少要经历再次标记过程。
标记的前提是对象在进行可达性分析后发现没有与GC Roots相连接的引用链

1. 第一次标记并进行一次筛选。
筛选的条件是此对象是否有必要执行finalize()方法
当对象没有覆盖finalize方法,对象将直接被回收

2. 第二次标记
如果这个对象覆盖了finalize方法,finalize方法是对象脱逃死亡命运的最后一次机会,如果对象要在finalize()中成功拯救自己,只要重新与引用链上的任何的一个对象建立关联即可,譬如把自己赋值给某个类变量或对象的成员变量,那在第二次标记时它将移除出“即将回收”的集合。如果对象这时候还没逃脱,那基本上它就真的被回收了。

注意一个对象的finalize()方法只会被执行一次,也就是说通过调用finalize方法自我救命的机会就一次。
示例代码:

public class OOMTest {

   public static void main(String[] args) {
      List<Object> list = new ArrayList<>();
      int i = 0;
      int j = 0;
      while (true) {
         list.add(new User(i++, UUID.randomUUID().toString()));
         new User(j--, UUID.randomUUID().toString());
      }
   }
}

//User类需要重写finalize方法
@Override
protected void finalize() throws Throwable {
    OOMTest.list.add(this);
    System.out.println("关闭资源,userid=" + id + "即将被回收");
}

finalize()方法的运行代价高昂, 不确定性大, 无法保证各个对象的调用顺序, 如今已被官方明确声明为不推荐使用的语法。 有些资料描述它适合做“关闭外部资源”之类的清理性工作, 这完全是对finalize()方法用途的一种自我安慰。 finalize()能做的所有工作, 使用try-finally或者其他方式都可以做得更好、更及时, 所以建议大家完全可以忘掉Java语言里面的这个方法。

四、常见引用类型

java的引用类型一般分为四种:强引用、软引用、弱引用、虚引用

强引用
普通的变量引用

public static User user = new User();

软引用:
将对象用SoftReference软引用类型的对象包裹,正常情况不会被回收,但是GC做完后发现释放不出空间存放新的对象,则会把这些软引用的对象回收掉软引用可用来实现内存敏感的高速缓存

public static SoftReference<User> user = new SoftReference<User>(new User());

软引用在实际中有重要的应用,例如浏览器的后退按钮。按后退时,这个后退时显示的网页内容是重新进行请求还是从缓存中取出呢?这就要看具体的实现策略了。
(1)如果一个网页在浏览结束时就进行内容的回收,则按后退查看前面浏览过的页面时,需要重新构建
(2)如果将浏览过的网页存储到内存中会造成内存的大量浪费,甚至会造成内存溢出

弱引用:
将对象用WeakReference软引用类型的对象包裹,弱引用跟没引用差不多,GC会直接回收掉,很少用

public static WeakReference<User> user = new WeakReference<User>(new User());

虚引用:
虚引用也称为幽灵引用或者幻影引用,它是最弱的一种引用关系,几乎不用


五、内存溢出、内存泄漏

内存泄漏是指不在被使用的对象或者变量一直背占据在内存总。
理论上来说,java是有GC垃圾回收机制的,也就是说,不再被使用的对象,会被QC自动回收掉,自动从内存中清清除。
但是,即使这样,java也还是有内存泄漏的情况,java导致内存泄漏的原因很明确:长生命周期的对象持有短生命周期的引用就有可能发生内存泄漏,尽管短生命周期对象已经不在被需要,但是因为长生命周期的对象一直持有它,没有进行释放,从而导致不能被GC回收掉,这就是java内存泄漏发生的场景。

举个项目中的例子
比如有个功能,有用户访问首页,我们有个静态Map,保存这个请求的IP地址,然后做一些校验或者业务处理,如果被大量的不同IP用户请求,因为静态变量的生命周期和JVM一样,导致一直无法被回收,迟早系统会oom掉。

总结

今天主要讲解了对象的创建和对象内存分配相关的内容,为后续JVM调优打基础;

如果有讲的不对的地方还请各位指点一二,如果觉得写的还可以,希望点个赞给我一点鼓舞,感谢!

  • 3
    点赞
  • 4
    收藏
    觉得还不错? 一键收藏
  • 打赏
    打赏
  • 0
    评论
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包

打赏作者

未闻花名丶丶

你的鼓励将是我创作的最大动力

¥1 ¥2 ¥4 ¥6 ¥10 ¥20
扫码支付:¥1
获取中
扫码支付

您的余额不足,请更换扫码支付或充值

打赏作者

实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值