JVM-对象创建&内存分配

  • 对象的创建
  • 对象内存分配
  • 对象内存回收

对象的创建

  1. 类加载检查: 虚拟机遇到一条new指令时,首先将去检查这个指令的参数是否能在常量池中定位到一个类的符号引用,并且检查这个符号引用代表的类是否已被加载、解析和初始化过。如果没有,那必须先执行相应的类加载过程。new指令对应到语言层面上讲是,new关键词、对象克隆、对象序列化等
  2. 分配内存:对象所需内存的大小在类加载完成后便可完全确定,为对象分配空间的任务等同于把一块确定大小的内存从Java堆中划分出来
    • 划分内存的方法
      • “指针碰撞”(Bump the Pointer)(默认用指针碰撞)
        • 如果Java堆中内存是绝对规整的,所有用过的内存都放在一边,空闲的内存放在另一边,中间放着一个指针作为分界点的指示器,那所分配内存就仅仅是把那个指针向空闲空间那边挪动一段与对象大小相等的距离
      • “空闲列表”(Free List)
        - 如果Java堆中的内存并不是规整的,已使用的内存和空闲的内存相互交错,那就没有办法简单地进行指针碰撞了,虚拟机就必须维护一个列表,记录上哪些内存块是可用的,在分配的时候从列表中找到一块足够大的空间划分给对象实例并更新列表上的记录
    • 在并发情况下, 可能出现正在给对象A分配内存,指针还没来得及修改,对象B又同时使用了原来的指针来分配内存的情况
      • CAS(compare and swap):虚拟机采用CAS配上失败重试的方式保证更新操作的原子性来对分配内存空间的动作进行同步处理
      • 本地线程分配缓冲(Thread Local Allocation Buffer, TLAB):­XX:+UseTLAB­ 默认开启 -­XX:TLABSize 指定 TLAB 大小
        • 把内存分配的动作按照线程划分在不同的空间之中进行,即每个线程在Java堆中预先分配一小块内存
  3. 初始化:内存分配完成后,虚拟机需要将分配到的内存空间都初始化为零值(不包括对象头)
    • 如果使用TLAB,这一工作过程也可以提前至TLAB分配时进行
    • 这一步操作保证了对象的实例字段在Java代码中可以不赋初始值就直接使用,程序能访问到这些字段的数据类型所对应的零值
  4. 设置对象头:例如这个对象是哪个类的实例、如何才能找到类的元数据信息、对象的哈希码、对象的GC分代年龄等信息。这些信息存放在对象的对象头Object Header之中
    • 在HotSpot虚拟机中,对象在内存中存储的布局可以分为3块区域:对象头(Header)、 实例数据(Instance Data)和对齐填充(Padding)

      • HotSpot虚拟机的对象头包括两部分信息
        • 第一部分用于存储对象自身的运行时数据, 如哈希码(HashCode)、GC分代年龄、锁状态标志、线程持有的锁、偏向线程ID、偏向时间戳等
        • 另外一部分是类型指针,即对象指向它的类元数据的指针,虚拟机通过这个指针来确定这个对象是哪个类的实例
  5. 执行<init>方法:即对象按照程序员的意愿进行初始化
    • 对应到语言层面上讲,就是为属性赋值(这与上面的赋零值不同,这是由程序员赋的值),和执行构造方法
  • 对象大小与指针压缩:可以用 jol­core 包查看
    • 指针压缩
      • jvm 配置参数:UseCompressedOops
        • compressed­­ 压缩、oop(ordinary object pointer)­­ 对象指针
      • 启用指针压缩:XX:+UseCompressedOops(默认开启)
      • 禁止指针压缩:­-XX:­UseCompressedOops
  • 为什么要进行指针压缩
    • 在64位平台的HotSpot中使用32位指针,内存使用会多出1.5倍左右,使用较大指针在主内存和缓存之间移动数据,占用较大宽带,同时GC也会承受较大压力
    • 为了减少64位平台下内存的消耗,启用指针压缩功能
    • 在jvm中,32位地址最大支持4G内存(2的32次方),可以通过对对象指针的压缩编码、解码方式进行优化,使得jvm只用32位地址就可以支持更大的内存配置(小于等于32G)
    • 堆内存小于4G时,不需要启用指针压缩,jvm会直接去除高32位地址,即使用低虚拟地址空间
    • 堆内存大于32G时,压缩指针会失效,会强制使用64位(即8字节)来对java对象寻址,这就会出现内存使用多出1.5倍左右的问题,所以堆内存不要大于32G为好

对象内存分配

  • 对象栈上分配:逃逸分析(-XX:+DoEscapeAnalysis)、标量替换(-XX:+EliminateAllocations
    • JAVA中的对象都是在堆上进行分配,当对象没有被引用的时候,需要依靠GC进行回收内存,如果对象数量较多的时候,会给GC带来较大压力,也间接影响了应用的性能,为了减少临时对象在堆内分配的数量,JVM通过逃逸分析确定该对象不会被外部访问
      • 如果不会逃逸可以将该对象在栈上分配内存,这样该对象所占用的内存空间就可以随栈帧出栈而销毁,就减轻了垃圾回收的压力
    • 逃逸分析:就是分析对象动态作用域,当一个对象在方法中被定义后,它可能被外部方法所引用
    • 标量替换:通过逃逸分析确定该对象不会被外部访问,并且对象可以被进一步分解时,JVM不会创建该对象,而是将该 对象成员变量分解若干个被这个方法使用的成员变量所代替,这些代替的成员变量在栈帧或寄存器上分配空间,这样就不会因为没有一大块连续空间导致对象内存不够分配
    • 标量与聚合量:标量即不可被进一步分解的量,而JAVA的基本数据类型就是标量(如:int,long等基本数据类型以及 reference 类型等),标量的对立就是可以被进一步分解的量,而这种量称之为聚合量。而在JAVA中对象就是可以被进一 步分解的聚合量
  • 对象在Eden区分配:大多数情况下,对象在新生代中 Eden 区分配(当 Eden 区没有足够空间进行分配时,虚拟机将发起一次 Minor GC)
    • Minor GC/Young GC:指发生新生代的的垃圾收集动作,Minor GC非常频繁,回收速度一般也比较快
    • Major GC/Full GC:一般会回收老年代 ,年轻代,方法区的垃圾,Major GC的速度一般会比Minor GC的慢10倍以上
    • Eden与Survivor区默认 8:1:1(让eden区尽量的大,survivor区够用即可)
      • -XX:+UseAdaptiveSizePolicy 默认开启,会导致这个 8:1:1 比例自动变化
      • 大量的对象被分配在eden区,eden区满了后会触发minor gc,可能会有99%以上的对象成为垃圾被回收掉,剩余存活的对象会被挪到为空的那块survivor区,下一次eden区满了后又会触发minor gc,把eden区和survivor区垃圾对象回收,把剩余存活的对象一次性挪动到另外一块为空的survivor区,因为新生代的对象都是朝生夕死的,存活时间很短,所以JVM默认的8:1:1的比例是很合适的
      • 如果对象太大无法存入Survior空间,就会提前转移到老年代
  • 大对象直接进入老年代:为了避免为大对象分配内存时的复制操作而降低效率
    • -XX:PretenureSizeThreshold 如果对象超过设置大小会直接进入老年代(这个参数只在 Serial 和ParNew两个收集器下有效)
  • 长期存活的对象将进入老年代:-XX:MaxTenuringThreshold (对象晋升到老年代的年龄阈值)
    • 如果对象在 Eden 出生并经过第一次 Minor GC 后仍然能够存活,并且能被 Survivor 容纳的话,将被移动到 Survivor 空间中,并将对象年龄设为 1
    • 对象在 Survivor 中每熬过一次 MinorGC,年龄就增加1岁,当它的年龄增加到一定程度(默认为15岁,CMS收集器默认6岁),就会被晋升到老年代中
  • 对象动态年龄判断:-XX:TargetSurvivorRatio 希望那些可能是长期存活的对象,尽早进入老年代
    • 对象动态年龄判断机制一般是在 minor gc 之后触发的
    • 当前放对象的Survivor区域里(其中一块区域,放对象的那块Survivor区),一批对象的总大小大于这块Survivor区域内存大小的50%(-XX:TargetSurvivorRatio),那么此时大于等于这批对象年龄最大值的对象,就可以直接进入老年代了
      • 例如Survivor区域里现在有一批对象,年龄1+年龄2+年龄n的多个年龄对象总和超过了Survivor区域的50%,此时就会把年龄n(含)以上的对象都放入老年代
  • 老年代空间分配担保机制
    • 年轻代每次minor gc之前JVM都会计算下老年代剩余可用空间

      • 如果这个可用空间小于年轻代里现有的所有对象大小之和(包括垃圾对象)
      • 就会看一个-XX:-HandlePromotionFailure (jdk1.8默认就设置了) 的参数是否设置了
        • 如果有这个参数,就会看看老年代的可用内存大小,是否大于之前每一次minor gc后进入老年代的对象的平均大小
        • 如果上一步结果是小于或者之前说的参数没有设置,那么就会触发一次Full gc,对老年代和年轻代一起回收一次垃圾,如果回收完还是没有足够空间存放新的对象就会发生"OOM"
    • 如果minor gc之后剩余存活的需要挪动到老年代的对象大小还是大于老年代可用空间,那么也会触发full gc,full gc完之后如果还是没有空间放minor gc之后的存活对象,则也会发生“OOM”


对象内存回收

  • 判断哪些对象已经死亡
    • 引用计数法(循环引用问题):给对象中添加一个引用计数器,每当有一个地方引用它,计数器就加1;当引用失效,计数器就减1;任何时候计数器为0的对象就是不可能再被使用的
      • 这个方法实现简单,效率高,但是目前主流的虚拟机中并没有选择这个算法来管理内存,其最主要的原因是它很难解决对象之间相互循环引用的问题
    • 可达性分析算法
      • 将“GC Roots” 对象作为起点,从这些节点开始向下搜索引用的对象,找到的对象都标记为非垃圾对象,其余未标记的对象都是垃圾对象

        • GC Roots根节点:线程栈的本地变量、静态变量、本地方法栈的变量等等
  • 常见引用类型
    • 强引用:普通的变量引用
    • 软引用(可用来实现内存敏感的高速缓存):将对象用SoftReference软引用类型的对象包裹,正常情况不会被回收,但是GC做完后发现释放不出空间存放新的对象,则会把这些软引用的对象回收掉3
    • 弱引用:将对象用WeakReference软引用类型的对象包裹,弱引用跟没引用差不多,GC会直接回收掉,很少用
    • 虚引用:虚引用也称为幽灵引用或者幻影引用,它是最弱的一种引用关系,几乎不用
  • finalize() 方法最终判定对象是否存活
    • 标记的前提是对象在进行可达性分析后发现没有与GC Roots相连接的引用链
    • 第一次标记并进行一次筛选
      • 筛选的条件是此对象是否有必要执行finalize()方法
      • 当对象没有覆盖finalize方法,对象将直接被回收
    • 第二次标记:对象覆盖了finalize方法
      • 只要重新与引用链上的任何的一个对象建立关联,那在第二次标记时它将移除出“即将回收”的集合
  • 如何判断一个类是无用的类(方法区主要回收的是无用的类)
    • 该类所有的实例都已经被回收,也就是 Java 堆中不存在该类的任何实例
    • 加载该类的 ClassLoader 已经被回收
    • 该类对应的 java.lang.Class 对象没有在任何地方被引用,无法在任何地方通过反射访问该类的方法
  • 6
    点赞
  • 8
    收藏
    觉得还不错? 一键收藏
  • 0
    评论
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值