【JVM篇】自动内存管理——运行时数据区

目录

前言

一、线程共享与线程不共享 

二、程序计数器

三、Java虚拟机栈

1. 局部变量表  

2. 操作数栈 

3. 帧数据 

四、本地方法栈

五、堆

六、方法区

1. 类的元信息

2. 运行时常量池

3. 字符串常量池

七、直接内存

总结


前言

  对于Java程序员来说,在虚拟机自动内存管理机制的帮助下,不再需要为每一个new操作去写配对的delete/free代码,不容易出现内存泄漏和内存溢出问题,看起来由虚拟机管理内存一切都很美好。不过,也正是因为Java程序员把控制内存的权力交给了Java虚拟机,一旦出现内存泄漏和溢出方面的问题,如果不了解虚拟机是怎样使用内存的,那排查错误、修正问题将会成为一项异常艰难的工作。因此,我们有必要了解JVM的运行时数据区。

  Java虚拟机在执行Java程序的过程中会把它所管理的内存划分为若干个不同的数据区域。Java虚拟机所管理的内存将会包括以下几个运行时数据区域:

一、线程共享与线程不共享 

        首先,我们需要理清线程共享和线程不共享这两个概念。线程共享是指多个线程可以访问相同的资源或数据,而线程不共享意味着每个线程都有其自己的、独立的副本,这意味着不会出现因多个线程同时访问而导致的数据竞争问题。在JVM中,程序计数器、Java虚拟机栈和本地方法栈是线程不共享的,方法区和堆是线程共享的。

二、程序计数器

  程序计数器也叫PC寄存器,每个线程会通过程序计数器记录当前要执行的字节码指令的地址。在加载阶段,虚拟机将字节码文件中的指令读取到内存之后,会将原文件中的偏移量转换成内存地址。每一条字节码指令都会拥有一个内存地址。在代码执行过程中,程序计数器会记录下一条字节码指令的地址。执行完当前指令之后,虚拟机的执行引擎根据程序计数器执行下一条指令。在多线程执行情况下,java虚拟机需要通过程序计数器记录CPU切换前解释执行到那一句指令并继续解释运行。此内存区域是唯一一个在《Java虚拟机规范》中没有规定任何OutOfMemoryError情况的区域,不会发生内存溢出。

三、Java虚拟机栈

  虚拟机栈描述的是Java方法执行的线程内存模型:每个方法被执行的时候,Java虚拟机都会同步创建一个栈帧(Stack Frame)用于存储局部变量表、操作数栈、动态链接、方法出口等信息。每一个方法被调用直至执行完毕的过程,就对应着一个栈帧在虚拟机栈中从入栈到出栈的过程。

  Java虚拟机栈中,如果线程请求的栈深度大于虚拟机所允许的深度,将抛出StackOverflowError异常;如果Java虚拟机栈容量可以动态扩展,当栈扩展时无法申请到足够的内存会抛出OutOfMemoryError异常。

1. 局部变量表  

  “栈”通常就是指这里讲的虚拟机栈,或者更多的情况下只是指虚拟机栈中局部变量表部分。局部变量表存放了编译期可知的各种Java虚拟机基本数据类型(boolean、byte、char、short、int、float、long、double)、对象引用(reference类型,它并不等同于对象本身,可能是一个指向对象起始地址的引用指针,也可能是指向一个代表对象的句柄或者其他与此对象相关的位置)和returnAddress类型(指向了一条字节码指令的地址,保存的是return后要执行的字节码的指令地址)​。

  这些数据类型在局部变量表中的存储空间以局部变量槽(Slot)来表示,其中64位长度的long和double类型的数据会占用两个变量槽,其余的数据类型只占用一个。局部变量表所需的内存空间在编译期间完成分配,当进入一个方法时,这个方法需要在栈帧中分配多大的局部变量空间是完全确定的,在方法运行期间不会改变局部变量表的大小。这里说的“大小”是指变量槽的数量,虚拟机真正使用多大的内存空间(譬如按照1个变量槽占用32个比特、64个比特,或者更多)来实现一个变量槽,这是完全由具体的虚拟机实现自行决定的事情。此外,局部变量表中的槽是可以复用的,一旦某个局部变量不再生效,当前槽就可以再次被使用,下图是一个局部变量槽被复用的示例。

2. 操作数栈 

  操作数栈是栈帧中虚拟机在执行指令过程中用来存放中间数据的一块区域。它是一种栈式的数据结构,如果一条指令将一个值压入操作数栈,则后面的指令可以弹出并使用该值。在编译期就可以确定操作数栈的最大深度,从而在执行时正确的分配内存大小。下图是利用jclasslib查看到的操作数栈的深度。

3. 帧数据 

  当前类的字节码指令引用了其他类的属性或者方法时,需要将符号引用(编号)转换成对应的运行时常量池中的内存地址。动态链接就保存了编号到运行时常量池的内存地址的映射关系。

动态链接:运行期间,将字节码文件中的符号引用转为直接引用。

静态链接:解析期间,将字节码文件中的符号引用转为直接引用。

  方法出口指的是方法在正确或异常结束时,当前栈帧会被弹出,同时程序计数器应该指向上一个栈帧中的下一条指令的地址。所以在当前栈帧中,需要存储此方法出口的地址。异常表存放的是代码中异常的处理信息,包含了异常捕获的生效范围以及异常发生后跳转到的字节码指令位置。  

四、本地方法栈

  本地方法栈(Native Method Stacks)与虚拟机栈所发挥的作用是非常相似的,其区别只是虚拟机栈为虚拟机执行Java方法(也就是字节码)服务,而本地方法栈则是为虚拟机使用到的本地(Native)方法服务。本地方法是指在Java等高级编程语言中,能够直接调用底层操作系统或硬件所支持的功能的函数。这些方法通常不是用高级语言编写,而是用C、C++或其他更接近硬件的底层低级语言实现,然后通过JNI(Java Native Interface)、P/Invoke(对于.NET框架)等机制与高级语言代码集成。

  《Java虚拟机规范》对本地方法栈中方法使用的语言、使用方式与数据结构并没有任何强制规定,因此具体的虚拟机可以根据需要自由实现它。此外,本地方法栈与Java虚拟机栈一样,也会在栈深度溢出或者栈扩展失败时分别抛出StackOverflowError和OutOfMemoryError异常。

五、堆

  Java堆(Java Heap)是虚拟机所管理的内存中最大的一块。Java堆是被所有线程共享的一块内存区域,在虚拟机启动时创建。此内存区域的唯一目的就是存放对象实例,Java世界里“几乎”所有的对象实例都在这里分配内存。  Java堆既可以被实现成固定大小的,也可以是可扩展的,不过当前主流的Java虚拟机都是按照可扩展来实现的(通过参数-Xmx和-Xms设定)​。如果在Java堆中没有内存完成实例分配,并且堆也无法再扩展时,Java虚拟机将会抛出OutOfMemoryError异常。

  堆空间有三个需要关注的值,used、total和max。其中,used指的是当前已使用的堆内存,total是java虚拟机已经分配的可用堆内存,max是java虚拟机可以分配的最大堆内存。如果堆内存不足,java虚拟机就会不断的分配内存,total值会变大。total最多只能与max相等。如果不设置任何的虚拟机参数,max默认是系统内存的1/4,total默认是系统内存的1/64。在实际应用中一般需要设置total和max的值。

六、方法区

  方法区(Method Area)与Java堆一样,是各个线程共享的内存区域,它用于存储已被虚拟机加载的类型信息、常量、静态变量、即时编译器编译后的代码缓存等数据。虽然《Java虚拟机规范》中把方法区描述为堆的一个逻辑部分,但是它却有一个别名叫作“非堆”(Non-Heap),目的是与Java堆区分开来。如果方法区无法满足新的内存分配需求时,将抛出OutOfMemoryError异常。

  《Java虚拟机规范》对方法区的约束是非常宽松的,除了和Java堆一样不需要连续的内存和可以选择固定大小或者可扩展外,甚至还可以选择不实现垃圾收集。相对而言,垃圾收集行为在这个区域的确是比较少出现的,但并非数据进入了方法区就如永久代的名字一样“永久”存在了。

  JDK8之前,使用永久代来实现方法区的决定并不是一个好主意,这种设计导致了Java应用更容易遇到内存溢出的问题(永久代有-XX:MaxPermSize的上限,即使不设置也有默认大小,而J9和JRockit只要没有触碰到进程可用内存的上限,例如32位系统中的4GB限制,就不会出问题)​,而且有极少数方法(例如String::intern())会因永久代的原因而导致不同虚拟机下有不同的表现。到了JDK 8,完全废弃了永久代的概念,改用与JRockit、J9一样在本地内存中实现的元空间(Meta-space)来代替。

1. 类的元信息

  方法区存储了每个类的基本信息(元信息),一般称之为InstanceKlass对象。在类的加载阶段完成。

2. 运行时常量池

  运行时常量池(Runtime Constant Pool)是方法区的一部分。Class文件中除了有类的版本、字段、方法、接口等描述信息外,还有一项信息是常量池表(Constant Pool Table),用于存放编译期生成的各种字面量与符号引用,这部分内容将在类加载后存放到方法区的运行时常量池中。既然运行时常量池是方法区的一部分,自然受到方法区内存的限制,当常量池无法再申请到内存时会抛出OutOfMemoryError异常。

  对于运行时常量池,​《Java虚拟机规范》并没有做任何细节的要求,不同提供商实现的虚拟机可以按照自己的需要来实现这个内存区域,不过一般来说,除了保存Class文件中描述的符号引用外,会把由符号引用翻译出来的直接引用存储在运行时常量池中。运行时常量池相对于Class文件常量池的另外一个重要特征是具备动态性,Java语言并不要求常量一定只有编译期才能产生,也就是说,并非预置入Class文件中常量池的内容才能进入方法区运行时常量池,运行期间也可以将新的常量放入池中。

静态常量池:Class文件中通过编号查表的方式找到常量,这种常量池成为静态常量池。

运行时常量池:当常量池加载到内存中之后,可以通过内存地址快速的定位到常量池中的内容,这种常量池称为运行时常量池。

3. 字符串常量池

  方法区中除了类的元信息、运行时常量池外,还有一块区域叫字符串常量池。字符串常量池存储在代码中定义的常量字符串内容。比如"123"这个123就会被放入字符串常量池。

  字符串常量池和运行时常量池有什么关系呢?早期设计时,字符串常量池是属于运行时常量池的一部分,它们存储的位置也是一致的。后续做出了调整,将字符串常量池和运行时常量池做了拆分。

七、直接内存

  直接内存(Direct Memory)并不是虚拟机运行时数据区的一部分,也不是《Java虚拟机规范》中定义的内存区域。但是这部分内存也被频繁地使用,而且也可能导致OutOfMemoryError异常出现。

  在JDK 1.4中新加入了NIO(New Input/Output)类,引入了一种基于通道(Channel)与缓冲区(Buffer)的I/O方式,它可以使用Native函数库直接分配堆外内存,然后通过一个存储在Java堆里面的DirectByteBuffer对象作为这块内存的引用进行操作。这样能在一些场景中显著提高性能,因为避免了在Java堆和Native堆中来回复制数据。

总结

  本篇文章主要介绍了JVM的运行时数据区域。这些区域各自承担着不同的角色,它们共同协作确保Java程序能够有效地运行。理解这些区域有助于Java开发者更好地诊断和解决内存相关的错误,比如内存泄漏和溢出问题。路漫漫其修远兮,吾将上下而求索,让我们共同努力!

  参考资料:

黑马程序员JVM:基础篇-18-运行时数据区-程序计数器_哔哩哔哩_bilibili

《深入理解Java虚拟机:JVM高级特性与最佳实践(第3版)》:深入理解Java虚拟机:JVM高级特性与最佳实践(第3版) - 2.1 概述 - 周志明 - 微信读书 (qq.com)

评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包

打赏作者

边城仔

你的鼓励将是我创作的最大动力

¥1 ¥2 ¥4 ¥6 ¥10 ¥20
扫码支付:¥1
获取中
扫码支付

您的余额不足,请更换扫码支付或充值

打赏作者

实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值