目录
3.1 程序计数器(Program Counter Register)
3.2 虚拟机栈(Virtual Machine Stack)
3.3 本地方法栈(Native Method Stacks)
3.6 运行时常量池(Runtime Constant Pool)
一、前言
对于从事C、C++程序开发的开发人员来说,在内存管理领域,他们既是拥有最高权力的“皇帝”,又是从事最基础工作的劳动人民;既拥有每一个对象的“所有权”,又担负着每一个对象生命从开始到终结的维护责任。
对于Java程序员来说,在虚拟机自动内存管理机制的帮助下,不再需要为每一个new操作去写配对的delete/free代码,不容易出现内存泄漏和内存溢出问题。不也正是因为Java程序员把控制内存的权力交给了Java虚拟机,一旦出现内存泄漏和溢出方面的问题,排查错误、修正问题将会成为一项异常艰难的工作。
本篇文章将从概念上介绍Java虚拟机内存的各个区域,讲解Java虚拟机运行时区域以及区域的作用、服务对象以及其中可能产生的问题。
二、正文
1.运行时数据区域
根据《Java虚拟机规范》的规定,Java虚拟机所管理的内存将会包括以下几个运行时数据区域。
其中灰色区域为所有线程共享的数据区域,白色区域为线程私有的数据区域。
2.运行时数据区域总结
区域名称 | 是否线程私有 | 异常类型 | 生命周期 | 特点 |
程序计数器 | 是 | 无 | 与线程一致 | 字节码的行号指示器、每个线程独立存储、无OOM |
虚拟机栈 | 是 | OOM、SOF | 与线程一致 | Java方法执行过程就是栈帧入栈和出站的过程 |
本地方法栈 | 是 | OOM、SOF | 与线程一致 | 本地方法执行过程就是栈帧入栈和出站的过程 |
堆 | 否 | OOM | 与虚拟机一致 | 虚拟机内存中最大的一块区域,几乎所有的对象实例都在这里分配内存。既可以固定大小,也可以是可扩展的。 |
方法区 | 否 | OOM | 与虚拟机一致 | 用于存储已被虚拟机加载的类型信息、常量、静态变量、即时编译器编译后的代码缓存等数据。 |
运行时常量池 | 否 | 与虚拟机一致 | 方法区的一部分,运行期间也可以将新的常量放入池中。 |
其他:
1、程序计数器、虚拟机栈、本地方法栈生命周期与线程一致,堆、方法区、运行时常量池与虚拟机生命周期一致。
2、栈不可以动态扩展内存,堆可以被实现成固定大小的,也可以是可扩展的。
3、栈空间分配(线程申请时)失败会导致OutOfMemoryError异常。
4、堆、方法区内存不足且无法再扩展时,会抛出OutOfMemoryError异常。
5、运行时常量池属于方法区的一部分,无法申请到(方法区)内存时,会抛出OutOfMemoryError异常。
3.运行时数据区域各区域详解
3.1 程序计数器(Program Counter Register)
程序计数器可以看作是当前线程所执行的字节码的行号指示器。字节码解释器就是通过改变这个计数器的值来选取下一条需要执行的字节码指令,它是程序控制流的指示器,分支、循环、跳转、异常处理、线程恢复等基础功能都需要依赖这个计数器来完成。
多线程是通过线程轮流切换、分配处理器执行时间的方式来实现的,为了线程切换后能恢复到正确的执行位置,每条线程都需要有一个独立的程序计数器,各条线程之间计数器互不影响,独立存储,因此程序计数器是线程私有的。
线程执行Java方法时,计数器记录的是正在执行的虚拟机字节码指令的地址;执行本地方法时值为空(Undefined)。此内存区域是唯一一个没有OutOfMemoryError的区域(即便是死循环)。
3.2 虚拟机栈(Virtual Machine Stack)
Java虚拟机栈也是线程私有的,它的生命周期与线程相同。虚拟机栈是方法执行的线程内存模型:每个方法被执行的时候,虚拟机都会同步创建一个栈帧(Stack Frame)用于存储局部变量表、操作数栈、动态连接、方法出口等信息。每一个方法被调用直至执行完毕的过程,就对应着一个栈帧在虚拟机栈中从入栈到出栈的过程。
“栈”通常是指虚拟机栈,或者更多的情况下只是指虚拟机栈中局部变量表部分。局部变量表存放了编译期可知的各种Java虚拟机基本数据类型、对象引用和returnAddress类型(指向字节码指令地址)。这些数据类型在局部变量表中的存储空间以局部变量槽(Slot)来表示,long和double类型占用两个变量槽,其余的数据类型只占用一个。局部变量表所需的内存空间在编译期间完成分配,方法在栈帧中需要分配多大的局部变量空间是完全确定的,方法运行期间不会改变局部变量表的大小(变量槽数量)。
如果线程请求的栈深度大于虚拟机所允许的深度,将抛出StackOverflowError异常;如果Java虚拟机栈容量可以动态扩展,当栈扩展时无法申请到足够的内存会抛出OutOfMemoryError异常。
3.3 本地方法栈(Native Method Stacks)
本地方法栈与虚拟机栈所发挥的作用是非常相似的,虚拟机栈为虚拟机执行Java方法(字节码)服务,而本地方法栈则是为虚拟机使用到的本地方法服务。
《Java虚拟机规范》对本地方法栈中方法使用的语言、使用方式与数据结构并没有任何强制规定,虚拟机可以自由实现它,比如Hot-Spot虚拟机直接就把本地方法栈和虚拟机栈合二为一。
3.4 堆(Heap)
堆是虚拟机所管理的内存中最大的一块,是被所有线程共享的一块内存区域,在虚拟机启动时创建。此内存区域的唯一目的就是存放对象实例,几乎所有的对象实例都在这里分配内存(由于即时编译技术(尤其逃逸分析技术)的进步,栈上分配、标量替换优化手段导致实例内存发生了一些微妙的变化)。
堆是垃圾收集器管理的内存区域(也被称为GC堆)。由于现代垃圾收集器大部分都是基于分代收集理论设计的,堆中经常会出现“新生代”“老年代”“永久代”“Eden空间”“From Survivor空间”“To Survivor空间”等名词(仅仅是一部分垃圾收集器的共同特性或者说设计风格而已,而非虚拟机的固有内存布局)。十年之前(以G1收集器的出现为分界),业界绝对主流的HotSpot虚拟机内部的垃圾收集器全部都基于“经典分代”来设计,需要新生代、老年代收集器搭配才能工作。但是当今HotSpot里面也出现了不采用分代设计的新垃圾收集器,就不能再说这些名词了。
堆可以划分出多个线程私有的分配缓冲区,以提升回收内存、分配内存。
根据《Java虚拟机规范》的规定,Java堆可以处于物理上不连续的但逻辑应该被视为连续的内存空间中。但对于大对象(典型的如数组对象),多数虚拟机实现出于实现简单、存储高效的考虑,很可能会要求连续的内存空间。
堆既可以被实现成固定大小的,也可以是可扩展的,不过当前主流的Java虚拟机都是按照可扩展来实现的(通过参数-Xmx和-Xms设定)。如果在Java堆中没有内存完成实例分配,并且堆也无法再扩展时,Java虚拟机将会抛出OutOfMemoryError异常。
3.5 方法区(Method Area)
方法区与堆一样,是各个线程共享的内存区域,用于存储已被虚拟机加载的类型信息、常量、静态变量、即时编译器编译后的代码缓存等数据。
永久代:
JDK 8以前,大家更愿意称呼方法区为“永久代”,因为HotSpot虚拟机设计团队选择把收集器的分代设计扩展至方法区,或者说使用永久代来实现方法区而已,这样使得HotSpot的垃圾收集器能够像管理Java堆一样管理这部分内存,省去专门为方法区编写内存管理代码的工作。但是其他虚拟机是不存在永久代的概念的。
当年使用永久代来实现方法区导致了Java应用更容易遇到内存溢出的问题(永久代有-XX:MaxPermSize的上限,不设置也有默认大小,而J9和JRockit只要没有触碰到进程可用内存的上限,例如32位系统中的4GB限制,就不会出问题),而且有极少数方法会因永久代的原因而导致不同虚拟机下有不同的表现。
当Oracle收购BEA获得了JRockit的所有权后,考虑到HotSpot未来的发展,在JDK 6的时候HotSpot开发团队就有放弃永久代,逐步改为采用本地内存来实现方法区的计划了,到了JDK 7的HotSpot,已经把原本放在永久代的字符串常量池、静态变量等移出,而到了JDK 8,终于完全废弃了永久代的概念,改用与JRockit、J9一样在本地内存中实现的元空间来代替,把JDK 7中永久代还剩余的内容(主要是类型信息)全部移到元空间中。
《Java虚拟机规范》对方法区的约束是非常宽松的,除了和Java堆一样不需要连续的内存和可以选择固定大小或者可扩展外,甚至还可以选择不实现垃圾收集。垃圾收集行为在这个区域的确是比较少出现的,但并非数据进入了方法区就如永久代的名字一样“永久”存在了。这区域的内存回收目标主要是针对常量池的回收和对类型的卸载,一般来说这个区域的回收效果比较难令人满意,尤其是类型的卸载,条件相当苛刻,但是这部分区域的回收有时又确实是必要的。
如果方法区无法满足新的内存分配需求时,将抛出OutOfMemoryError异常。
3.6 运行时常量池(Runtime Constant Pool)
运行时常量池是方法区的一部分。Class文件中除了有类的版本、字段、方法、接口等描述信息外,还有一项信息是常量池表,用于存放编译期生成的各种字面量与符号引用,这部分内容将在类加载后存放到方法区的运行时常量池中。
Java虚拟机对于Class文件每一部分的格式都有严格规定,必须符合规范才会被虚拟机认可、加载和执行。但对运行时常量池却并没有做任何细节的要求,不过一般来说,除了保存Class文件中描述的符号引用外,还会把由符号引用翻译出来的直接引用也存储在运行时常量池中。
运行时常量池相对于Class文件常量池的另外一个重要特征是具备动态性,Java语言并不要求常量一定只有编译期才能产生,也就是说,并非预置入Class文件中常量池的内容才能进入方法区的运行时常量池,运行期间也可以将新的常量放入池中。
运行时常量池是方法区的一部分,会受到方法区内存的限制,当常量池无法再申请到内存时会抛出OutOfMemoryError异常。
3.7 直接内存(Direct Memory)
直接内存并不是虚拟机运行时数据区的一部分,但是这部分内存也被频繁地使用,而且也可能导致OutOfMemoryError异常出现,所以我们放到这里特殊讲解一下。
在JDK 1.4中新加入了NIO(New Input/Output)类,引入了一种基于通道(Channel)与缓冲区(Buffer)的I/O方式,它可以使用Native函数库直接分配堆外内存,然后通过一个存储在Java堆里面的DirectByteBuffer对象作为这块内存的引用进行操作。这样能在一些场景中显著提高性能,因为避免了在Java堆和Native堆中来回复制数据。
显然,本机直接内存的分配不会受到Java堆大小的限制,但是,既然是内存,则肯定还是会受到本机总内存(包括物理内存、SWAP分区或者分页文件)大小以及处理器寻址空间的限制,一般服务器管理员配置虚拟机参数时,会根据实际内存去设置-Xmx等参数信息,但经常忽略掉直接内存,使得各个内存区域总和大于物理内存限制(包括物理的和操作系统级的限制),从而导致动态扩展时出现OutOfMemoryError异常。