虚拟机类加载机制

一、定义
虚拟机将class文件加载到内存,并且对数据进行校验、转换解析和初始化,最终形成可以被虚拟机直接使用的java类型,这就是虚拟机的类加载机制。与那些在编译时需要进行连接工作的语言不同,java中类型的加载、连接和初始化都是在程序的运行期间完成的。

二、类加载的生命周期
加载过程:加载
连接过程:验证、准备、解析
初始化过程:初始化
使用过程:使用、卸载
类的加载过程必须按照这种顺序按部就班开始,而解析阶段则不一定:它在某些情况下可以在初始化阶段之后再开始,这是为了支持java语言的运行期绑定。这里是按部就班开始,而不是按部就班的进行或者完成,这些阶段通常是互相交叉地混合式进行,通常会在一个阶段执行的过程中调用、激活另一个阶段。
对于类加载过程的第一个阶段:加载,java虚拟机规范中并没有进行强制约束,这点可以交给虚拟机的具体实现来把握。但是对于初始化阶段,虚拟机规范则是严格规定了有且只有5种情况必须立即对类进行”初始化”(而加载、验证、准备自然需要在其前面开始):

  • 遇到newgetstaticputstaticinvokestatic这4条字节码指令时,如果类没有进行过初始化。生成这4条指令的最常见java代码场景是:使用new关键字进行实例化对象的时候、读取或者设置一个静态字段(被final修饰、已在编译器把结果放入常量池的静态字段除外)的时候,以及调用一个类的静态方法的时候。
  • 使用java.lang.reflect包的方法对类进行反射调用的时候,如果类没有进行过初始化,则需要先触发其初始化。
  • 当初始化一个类的时候,如果发现其父类还没有进行初始化,则需要先触发其父类的初始化。
  • 当虚拟机启动时,用户需要指定一个要执行的主类(包含main()方法的那个类),虚拟机会先初始化这个主类。
  • 当使用JDK1.7的动态语言支持时,如果一个java.lang.invoke.MethodHandle实例后的解析结果REF_getStaticREF_putStaticREF_invokeStatic的方法句柄,并且这个方法句柄所对应的类没有进行过初始化,则需要先触发其初始化。

注意:有且只有这5种主动引用才会引起初始化,而被动引用是不会进行初始化的。
被动引用举例:

  • 子类调用父类的静态属性或方法,只会进行父类初始化,而子类不会进行初始化。
  • 通过数组定义引用类,不会触发此类的初始化。newarray指令会引起虚拟机自动生成的另一种类的初始化。
  • 常量在编译阶段会存入调用类的常量池中,本质上没有直接引用到定义的常量的类,因此会触发定义常量的类的初始化。

三、类加载过程详解
1、加载
加载是类加载过程的第一个阶段。在加载阶段,虚拟机需要完成一下3件事情:

  • 通过一个类的全限定名来获取定义此类的二进制字节流。
  • 将这个字节流所代表的静态存储结构转化为方法区的运行时数据结构。
  • 在内存中生成一个代表这个类的java.lang.Class对象,作为方法区这个类的各种数据访问的入口。

这里写图片描述

虚拟机规范的这3点要求其实不算具体,因此虚拟机实现与具体应用的灵活度都是相当大的。比如”通过一个类的全限定名来获取定义此类的二进制字节流”这条,它没有指明二进制字节流要从哪里获取、怎样获取。虚拟机设计团队在加载阶段搭建了一个相当开放的、广阔的”舞台”,充满创造力的开发人员则在这个舞台上玩出了各种各样的花样。例如:

  • 从ZIP包里读取,这是很常见,最终成为日后JAREARWAR格式的基础。
  • 从网络中获取,这种场景最典型的就是Applet。
  • 运行时计算生成,这种场景使用得最多的就是动态代理技术,在java.lang.reflect.Proxy中,就是用ProxyGenerator.generateProxyClass来为特定接口生成形式为"*$Proxy"的代理类的二进制字节流。
  • 由其他文件获得,典型场景是JSP应用,即由JSP文件生成对应的Class的类。
  • 从数据库中读取,这种场景相对较少,例如有些中间件服务器(SAP
    Netweaver)可以选择把程序安装到数据库中来完成程序代码在集群间的分发。

相对于类加载过程的其他阶段,一个非数组类的加载过程(准确地说,是加载过程中获取类的二进制字节流的动作)是开发人员可控性最强的,因为加载阶段既可以使用系统提供的引导类加载器来完成,也可以由用户自定义的类加载器去完成,开发人员可以通过定义自己的类加载器去控制字节流的获取方式(即重写一个类加载器的loadClass()方法)。
对于数组类而言,情况有所不同,数组类本身不通过类加载器创建,它是由java虚拟机直接创建的。但是数组类与类加载器仍有密切关系,因为数组类的创建在去掉所有纬度后最终还是要靠类加载器去创建。

2、验证
首先要清楚,在加载过程尚未完成时,连接阶段可能已经开始。
验证是连接阶段的第一步,验证阶段的目的是确保class文件中包含的信息符合虚拟机的要求,并且不会危害到虚拟机自身的安全。验证的内容主要包含以下几个方面:

  • 文件格式验证。主要目的是保证输入的字节流能正确的解析并存储在方法区中,格式上符合一个Java类型信息的要求。这个阶段的验证是基于二进制字节流进行的,只有通过了这个阶段的验证,字节流才能进入方法区进行存储,所有后面的3个阶段的验证都是基于方法区的存储结构进行的,不会直接操作字节流。
  • 元数据验证。这一阶段的主要目的是对类的元数据(定义数据的数据)信息进行语义校验,确保不存在不符合Java语言规范的元数据信息。包括:该类是否有父类、该类的父类是否继承了不允许被继承的类、该类中的字段和方法是否与父类产生矛盾等等。
  • 字节码验证。目的是通过数据流和控制流分析,确定程序语义是否合法、符合逻辑。在第二阶段对元数据信息的数据类型做完校验后,这个阶段将对类的方法体进行分析,保证被校验的类的方法在运行时不会危害虚拟机的安全。
  • 符号引用验证。符号引用验证发生在虚拟机将符号引用转化为直接引用的时候,这个转化动作是在连接的第三阶段——解析阶段中进行的。符号引用验证的目的是确保解析动作能够正常执行。
  • 对于类加载机制而言,验证阶段是一个非常重要、但不是一定必要的阶段。如果所运行的全部代码都已经被反复使用和验证过了,那么就可以使用虚拟机参数-Xverify:none来关闭大部分的类验证措施,以缩短类加载的时间。
    这里写图片描述

3、准备
准备阶段的主要工作是为类的静态变量分配内存并设置变量的初始默认值。这些变量所使用的内存都在方法区中分配。这里有两个问题需要说明:

  • 这一阶段进行内存分配的仅包括静态变量,而不包括实例变量(静态变量是所有对象共有的,实例变量是对象私有的),实例变量将会在对象实例化时随着对象一起分配在Java堆中。
  • 这里说的为对象赋初始值是各数据类型对应的零值。假设有一个静态变量定义为public static int a = 123;
    那变量a的初始值就是0而不是123,初始值123在初始化阶段赋给变量a。如果是引用类型初始默认值就是null。
  • 如果类字段的字段属性表中存在ConstantValue属性,那么在准备阶段就会是指定的值。假设有一个静态变量定义为public
    static int a = 123; 那变量a的初始值就是123。

4、解析
解析阶段是虚拟机将常量池内的符号引用替换为直接引用的过程。
符号引用:符号引用以一组符号来描述所引用的目标,符号可以使任何形式的字面量,只要使用时能无歧义的定位到目标即可。符号引用的字面量形式在Java虚拟机规范的Class文件格式中有明确定义。
直接引用:直接引用可以是直接指向目标的指针、相对偏移量或者是一个能间接定位到目标的句柄。直接引用是和虚拟机实现的内存布局有关的,同一个符号引用在不同虚拟机实例上翻译出来的直接引用一般不会相同。如果有了直接引用,那么引用的目标必定已经在内存中存在。
解析动作主要针对类或接口、字段、静态方法、接口方法、方法类型、方法句柄和调用点限定符这几类符号引用进行。

5、初始化
类初始化阶段是类加载过程的最后一步,初始化阶段是执行类构造器<clinit>()方法的过程。
<clinit>()是由编译器自动收集类中的所有类变量的赋值动作和静态语句块中的语句合并产生的,编译器手机的顺序是由语句在源文件中出现的顺序所决定的,静态语句块只能访问到定义在静态语句块之前的变量,定义在它之后的变量,在前的静态块可以复制,但是不能访问。

  • 类的构造器<clinit>()和实例构造器<init>()不同,它不需要显式地调用父类构造器,虚拟机会保证在子类的<clinit>()方法执行之前,父类的<clinit>()方法已经执行完毕,因此在虚拟机中第一个被执行<clinit>()方法的类肯定是java.lang.Object。该特点也意味着父类的静态内容要先于父类的复制操作。
  • <clinit>()对于类或者接口来说并不是必需的,如果一个类中没有静态语句块,也没有对变量的赋值操作,那么编译器可以不为这个类生成<clinit>()
  • 接口中不能使用静态语句块,但仍然有变量初始化的赋值操作,因此接口与类都一样会生成<clinit>()方法。但是之间不同的是,执行接口的<clinit>()不需要先执行父接口的<clinit>()方法。只有当父接口中定义的变量使用时,父接口才会初始化。另外,接口的实现类在初始化时也一样不会执行接口的<clinit>()方法。
  • 虚拟机会保证一个类的<clinit>()方法在多线程环境中被正确地加锁、同步,如果多个线程同时去初始化一个类,那么只会有一个线程去执行这个类的<clinit>()方法,其他线程都需要阻塞等待,直到活动线程执行<clinit>()方法完毕。如果在一个类的<clinit>()方法中有耗时很长的操作,就可能造成多个进程阻塞,在实际应用中这种阻塞很隐蔽。
  • 0
    点赞
  • 0
    收藏
    觉得还不错? 一键收藏
  • 0
    评论

“相关推荐”对你有帮助么?

  • 非常没帮助
  • 没帮助
  • 一般
  • 有帮助
  • 非常有帮助
提交
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值