第 1 章 JVM 和 Java 体系架构
1、JVM 前言
- 作为Java工程师, 你是否也遇到过这些问题?
- 运行着的线上系统突然卡死,系统无法访问,甚至直接
OOM
! - 想解决线上
JVM GC问题
,但却无从下手。 - 新项目上线,对各种
JVM参数设置
一脸茫然,直接默认吧然后就GG了 - 每次面试之前都要重新背一遍JVM的一些原理概念性的东西,然而面试官却经常问你在实际项目中如何调优VM参数,如何解决GC、OOM等问题,一脸懵逼。
- 大部分Java开发人员,除了会在项目中使用到与Java平台相关的各种高精尖技术,对于Java技术的核心Java虚拟机了解甚少。
- 一些有一定工作经验的开发人员,打心眼儿里觉得SSM、微服务等上层技术才是重点,基础技术并不重要,这其实是一种本末倒置的“病态”。如果我们把核心类库的API比做数学公式的话,那么Java虚拟机的知识就好比公式的推导过程。
- 计算机系统体系对我们来说越来越远,在不了解底层实现方式的前提下,通过高级语言很容易编写程序代码。但事实上计算机并不认识高级语言。
- 应该如何让我的系统更快?
- 如何避免系统出现瓶颈?
知乎上有条帖子:应该如何看招聘信息,直通年薪50万+?
- 参与现有系统的性能优化,重构,保证平台性能和稳定性
- 根据业务场景和需求,决定技术方向,做技术选型
- 能够独立架构和设计海量数据下高并发分布式解决方案,满足功能和非功能需求
- 解决各类潜在系统风险,核心功能的架构与代码编写
- 分析系统瓶颈,解决各种疑难杂症,性能调优等
面试
的需要(BATJ、TMD,PKQ等面试都爱问)- 中高级程序员必备技能:
项目管理、调优的需求
- 追求极客的精神,比如:
垃圾回收算法、JIT(即时编译器)、底层原理
垃圾收集机制
为我们打理了很多繁琐的工作,大大提高了开发的效率,但是,垃圾收集也不是万能的,懂得JVM内部的内存结构、工作机制,是设计高扩展性应用和诊断运行时问题的基础,也是Java工程师进阶的必备能力。- C语言需要自己来分配内存和回收内存,Java全部交给JVM进行分配和回收。
英文文档规范:https://docs.oracle.com/javase/specs/index.html
中文书籍:
- Java是目前应用最为广泛的软件开发平台之一。随着Java以及Java社区的不断壮大Java 也早已不再是简简单单的一门计算机语言了,它更是一个平台、一种文化、一个社区。
- 作为一个
平台
,Java虚拟机
扮演着举足轻重的作用- Groovy、Scala、JRuby、Kotlin等都是Java平台的一部分
- 作为一种
文化
,Java几乎成为了“开源”的代名词。- 第三方开源软件和框架。如Tomcat、Struts,MyBatis,Spring等。
- 就连JDK和JVM自身也有不少开源的实现,如openJDK、Harmony。
- 作为一个
社区
,Java拥有全世界最多的技术拥护者和开源社区支持,有数不清的论坛和资料。从桌面应用软件、嵌入式开发到企业级应用、后台服务器、中间件,都可以看到Java的身影。其应用形式之复杂、参与人数之众多也令人咋舌。
(重点)
- 每个
Java程序
都需要转换成字节码文件
,最后转换的字节码文件都能通过Java虚拟机进行运行和处理
- 随着Java7的正式发布,Java虚拟机的设计者们通过JSR-292规范基本实现在Java虚拟机平台上运行非Java语言编写的程序。
- Java虚拟机根本不关心运行在其内部的程序到底是使用何种编程语言编写的,它只关心“字节码”文件。也就是说Java虚拟机拥有语言无关性,并不会单纯地与Java语言“终身绑定”,
只要其他编程语言的编译结果满足并包含Java虚拟机的内部指令集、符号表以及其他的辅助信息,它就是一个有效的字节码文件,就能够被虚拟机所识别并装载运行
。
(重点)
- 我们平时说的
Java字节码
,指的是用Java语言编译成的字节码
。准确的说任何能在jvm平台上执行的字节码格式都是一样的。所以应该统称为:jvm字节码。 - 不同的编译器,可以编译出相同的字节码文件,字节码文件也可以在不同的JVM上运行。
Java虚拟机
与Java语言
并没有必然的联系,JVM只与特定的二进制文件格式——Class文件格式所关联,Class文件中包含了Java虚拟机指令集(或者称为字节码、Bytecodes)和符号表,还有一些其他辅助信息。
- Java平台上的
多语言混合编程
正成为主流
,通过特定领域的语言去解决特定领域的问题是当前软件开发应对日趋复杂的项目需求的一个方向。 - 试想一下,在一个项目之中,并行处理用Clojure语言编写,展示层使用JRuby/Rails,中间层则是Java,每个应用层都将使用不同的编程语言来完成,而且,接口对每一层的开发者都是透明的,各种语言之间的交互不存在任何困难,就像使用自己语言的原生API一样方便,因为它们生成的字节码都可以运行在一个虚拟机之上。
- 对这些运行于Java虚拟机之上、Java之外的语言,来自系统级的、底层的支持正在迅速增强,以
JSR-292
为核心的一系列项目和功能改进(如DaVinci Machine项目、Nashorn引擎、InvokeDynamic指令、java.lang.invoke包等),推动Java虚拟机从“Java语言的虚拟机”向 “多语言虚拟机”的方向发展。
- 1990年,在Sun计算机公司中,由Patrick Naughton、MikeSheridan及James Gosling领导的小组Green Team,开发出的新的程序语言,命名为Oak,后期命名为Java
- 1995年,Sun正式发布Java和HotJava产品,Java首次公开亮相。
- 1996年1月23日Sun Microsystems发布了JDK 1.0。
- 1998年,JDK1.2版本发布。同时,Sun发布了JSP/Servlet、
EJB规范(太笨重, 后来被Spring取代)
,以及将Java分成了J2EE、J2SE和J2ME。这表明了Java开始向企业、桌面应用和移动设备应用3大领域挺进。 - 2000年,JDK1.3发布,Java HotSpot Virtual Machine正式发布,成为
Java的默认虚拟机
。 - 2002年,JDK1.4发布,古老的Classic虚拟机退出历史舞台。
- 2003年年底,Java平台的scala正式发布,同年Groovy也加入了Java阵营。
- 2004年,JDK1.5发布。同时JDK1.5改名为JavaSE5.0。
- 2006年,JDK6发布。同年,
Java开源并建立了OpenJDK
。顺理成章,Hotspot虚拟机也成为了OpenJDK中的默认虚拟机。 - 2007年,Java平台迎来了新伙伴Clojure。
- 2008年,oracle收购了BEA,得到了
JRockit虚拟机(号称世界上最快的JVM)
。 - 2009年,Twitter宣布把后台大部分程序从Ruby迁移到Scala,这是Java平台的又一次大规模应用。
- 2010年,Oracle收购了Sun,获得Java商标和最真价值的HotSpot虚拟机。此时,Oracle拥有市场占用率最高的两款虚拟机
HotSpot
和JRockit
,并计划在未来对它们进行整合:HotRockit - 2011年,
JDK7
发布。在JDK1.7u4中,正式启用了新的垃圾回收器G1
。 - 2017年,
JDK9
发布。将G1设置为默认GC,替代CMS垃圾回收器
- 同年,IBM的J9开源,形成了现在的Open J9社区
- 2018年,Android的Java侵权案判决,Google赔偿Oracle计88亿美元
- 同年,Oracle宣告JavagE成为历史名词JDBC、JMS、Servlet赠予Eclipse基金会
- 同年,
JDK11发布
,LTS版本的JDK,发布革命性的ZGC(低延迟, 高吞吐的垃圾回收器(目前最强大的的GC, 还在测试环境下))
,调整JDK授权许可
- 2019年,JDK12发布,加入RedHat领导开发的
Shenandoah GC
.(OpenJDK中加入了Shenandoah GC)
(重点)
13.1、虚拟机概念
- 所谓
虚拟机(Virtual Machine)
,就是一台虚拟的计算机
。它是一款软件
,用来执行一系列虚拟计算机指令
。大体上,虚拟机可以分为系统虚拟机和程序虚拟机。
- 大名鼎鼎的Virtual Box,VMware就属于系统虚拟机,它们完全是对物理计算机的仿真,提供了一个
可运行完整操作系统
的软件平台。 - 程序虚拟机的典型代表就是
Java虚拟机
,它专门为执行单个计算机程序而设计,在Java虚拟机中执行的指令我们称为Java字节码指令
。 - 无论是系统虚拟机还是程序虚拟机,在上面运行的软件都被限制于虚拟机提供的资源中。
Java虚拟机
是一台执行Java字节码
的虚拟计算机
,它拥有独立的运行机制,其运行的Java字节码也未必由Java语言编译而成。- JVM平台的各种语言可以共享Java虚拟机带来的
跨平台性、优秀的垃圾回器,以及可靠的即时编译器。
- Java技术的核心就是Java虚拟机(JVM,Java Virtual Machine),因为
所有的Java程序都运行在Java虚拟机内部。
- Java虚拟机就是二进制字节码的运行环境,负责装载字节码到其内部,解释/编译为对应平台上的机器指令执行。每一条Java指令,Java虚拟机规范中都有详细定义,如怎么取操作数,怎么处理操作数,处理结果放在哪里。
特点:
一次编译,到处运行
自动内存管理
自动垃圾回收功能
- JVM是运行在操作系统之上的,它与硬件没有直接的交互
Java的体系结构
(重点)
HotSpot VM
是目前市面上高性能虚拟机的代表作之一 (目前使用最多, 根正苗红的虚拟机)。- 它采用解释器与即时编译器并存的架构。
- 在今天,Java程序的运行性能早已脱胎换骨,已经达到了可以和C/C++程序一较高下的地步。
执行引擎包含三部分:解释器,即时编译器,垃圾回收器
(重点)
- 凡是能生成被
Java虚拟机
所能解释、运行的字节码文件
,那么理论上我们就可以自己设计一套语言了
(了解)
- Java编译器输入的指令流基本上是一种基于
栈的指令集架构
,另外一种指令集架构则是基于寄存器的指令集架构
。具体来说:这两种架构之间的区别:
- 基于栈式架构的特点:
- 设计和实现更简单,适用于资源受限的系统;
- 避开了寄存器的分配难题:使用零地址指令方式分配
- 指令流中的
指令大部分是零地址指令
,其执行过程依赖于操作数栈
。指令集更小,编译器容易实现 - 不需要硬件支持,
可移植性更好,更好实现跨平台
- 基于寄存器架构的特点:
- 典型的应用是x86的二进制指令集:比如传统的PC以及Android的Davlik虚拟机。
- 指令集架构则完全依赖硬件,
与硬件的耦合度高,可移植性差
- 性能优秀和执行更高效
- 花费更少的指令去完成一项操作
- 在大部分情况下,基于寄存器架构的指令集往往都以
一地址指令、二地址指令和三地址指
令为主,而基于栈式架构的指令集却是以零地址指令为主。
-
同样
执行2+3
这种逻辑操作,其指令分别如下: -
基于栈的计算流程(以Java虚拟机为例):
iconst_2 // 将整数2压入操作数栈
istore_1 // 把栈顶的内容放入局部变量表中索引为 1 的 slot 中
iconst_3 // 将整数3压入操作数栈
istore_2 // 把栈顶的内容放入局部变量表中索引为 2 的 slot 中
iload_1 // 把局部变量表索引为 1 的 slot 中存放的变量值 加载至操作数栈
iload_2 // 把局部变量表索引为 2 的 slot 中存放的变量值 加载至操作数栈
iadd // 栈顶的两个数出栈后相加,结果入栈
istore_0 // 把栈顶的内容放入局部变量表中索引为 0 的 slot 中
return // 方法返回指令,回到调用点
- 而基于寄存器的计算流程
mov eax,2 //将eax寄存器的值设为1
add eax,3 //使eax寄存器的值加3
12
17.4、如何反编译字节码文件
- 编写 java 代码,编译生成字节码文件
public class StackStruTest {
public static void main(String[] args) {
int i = 2;
int j = 3;
int k = i + j;
}
}
- 在 .class 文件的同级目录下,执行反编译
javap -v StackStruTest.class
javap -v StackStruTest.class
反编译得到的指令
public static void main(java.lang.String[]);
descriptor: ([Ljava/lang/String;)V
flags: ACC_PUBLIC, ACC_STATIC
Code:
stack=2, locals=4, args_size=1
0: iconst_2 // 将常量 2 压入栈中
1: istore_1 // 将常量 2 保存至变量 i 中
2: iconst_3 // 将常量 3 压入栈中
3: istore_2 // 将常量 3 保存至变量 j 中
4: iload_1 // 加载变量 i
5: iload_2 // 加载变量 j
6: iadd // 执行累加操作
7: istore_3 // 加法结果保存在变量 k 中
8: return
LineNumberTable:
line 10: 0
line 11: 2
line 12: 4
line 22: 8
LocalVariableTable:
Start Length Slot Name Signature
0 9 0 args [Ljava/lang/String;
2 7 1 i I
4 5 2 j I
8 1 3 k I
}
17.5、JVM 架构总结
- 由于
跨平台性的设计
,Java的指令都是根据栈
来设计的。不同平台CPU架构不同,所以不能设计为基于寄存器的。优点是跨平台,指令集小,编译器容易实现,缺点是性能下降,实现同样的功能需要更多的指令
- 时至今日,尽管嵌入式平台已经不是Java程序的主流运行平台了(准确来说应该是HotSpot VM的宿主环境已经不局限于嵌入式平台了),那么为什么不将架构更换为基于寄存器的架构呢?
- 因为
基于栈的架构跨平台性好、指令集小
,虽然相对于基于寄存器的架构来说,基于栈的架构编译得到的指令更多,执行性能也不如基于寄存器的架构好,但考虑到其跨平台性与移植性,我们还是选用栈的架构
- Java虚拟机的启动是通过
引导类加载器(bootstrap class loader)
创建一个初始类(initial class)来完成的,这个类是由虚拟机的具体实现指定的。
- 执行Java程序
- 一个运行中的Java虚拟机有着一个清晰的任务:
执行Java程序
- 程序开始执行时它才运行,程序结束时它就停止
- 执行一个所谓的Java程序的时候,真真正正在执行的是一个叫做
Java虚拟机的进程
有如下的几种情况:
程序正常执行结束
- 程序在执行过程中
遇到了异常或错误
而异常终止 - 由于
操作系统出现错误
而导致Java虚拟机进程终止 - 某
线程调用Runtime类或System类的exit()方法,或Runtime类的halt()方法,并且Java安全管理器也允许这次exit()或halt()操作
。 - 除此之外,
JNI(Java Native Interface)规范描述了用JNI Invocation API来加载或卸载 Java虚拟机时
,Java虚拟机的退出情况。
- 代码
public class StackStruTest {
public static void main(String[] args) {
int i = 2;
int j = 3;
int k = i + j;
try {
Thread.sleep(6000);
} catch (InterruptedException e) {
e.printStackTrace();
}
System.out.println("hello");
}
}
-
程序在运行的时候,使用 jps 指令查看当前正在运行的进程,图中 23756 为进程所占用的端口号
-
StackStruTest 进行执行完毕,就查看不到了
(了解)
Runtime 类源码分析
Runtime(单例) 对象全局唯一
,对应着下图中的【运行时数据区】
- 明显的
饿汉单例设计模式
:一上来就 new 了一个 Runtime 类的实例,并且将 Runtime 类的构造器私有化
public class Runtime {
private static Runtime currentRuntime = new Runtime();
/**
* Returns the runtime object associated with the current Java application.
* Most of the methods of class Runtime
are instance
* methods and must be invoked with respect to the current runtime object.
*
* @return the Runtime
object associated with the current
* Java application.
*/
public static Runtime getRuntime() {
return currentRuntime;
}
/** Don't let anyone else instantiate this class */
private Runtime() {}
- Runtime 类的 exit() 方法调用了 ShutDown 类的 exit() 方法
public void exit(int status) {
SecurityManager security = System.getSecurityManager();
if (security != null) {
security.checkExit(status);
}
Shutdown.exit(status);
}
ShutDown 类源码分析
exit() 方法
会调用到本地方法 runAllFinalizers() 和halt0()
static void exit(int status) {
boolean runMoreFinalizers = false;
synchronized (lock) {
if (status != 0) runFinalizersOnExit = false;
switch (state) {
case RUNNING: /* Initiate shutdown */
state = HOOKS;
break;
case HOOKS: /* Stall and halt */
break;
case FINALIZERS:
if (status != 0) {
/* Halt immediately on nonzero status */
halt(status);
} else {
/* Compatibility with old behavior:
* Run more finalizers and then halt
*/
runMoreFinalizers = runFinalizersOnExit;
}
break;
}
}
if (runMoreFinalizers) {
runAllFinalizers();
halt(status);
}
synchronized (Shutdown.class) {
/* Synchronize on the class object, causing any other thread
* that attempts to initiate shutdown to stall indefinitely
*/
sequence();
halt(status);
}
}
static void halt(int status) {
synchronized (haltLock) {
halt0(status);
}
}
static native void halt0(int status);
/* Wormhole for invoking java.lang.ref.Finalizer.runAllFinalizers */
private static native void runAllFinalizers();
System 类源码分析
- System.exit() 方法调用了 Runtime.exit() 方法
public static void exit(int status) {
Runtime.getRuntime().exit(status);
}
总结
- 调用
System.exit()
方法 --> 调用Runtime.exit()
方法 - 调用
Runtime.exit()
方法 --> 调用了ShutDown.exit()
方法
(了解)
-
HotSpot历史
- 最初由一家名为“Longview Technologies”的小公司设计
- 1997年,此公司被Sun收购;2009年,Sun公司被甲骨文收购。
- JDK1.3时,HotSpot VM成为默认虚拟机
-
目前Hotspot占有绝对的市场地位,称霸武林。
- 不管是现在仍在广泛使用的JDK6,还是使用比例较多的JDK8中,
默认的虚拟机都是HotSpot
- Sun/oracle JDK和openJDK的默认虚拟机
- 因此本教程介绍的虚拟机都是HotSpot,
相关机制也主要是指HotSpot的GC机制
。(比如其他两个商用虚机都没有方法区的概念)
- 不管是现在仍在广泛使用的JDK6,还是使用比例较多的JDK8中,
-
从服务器、桌面到移动端、嵌入式都有应用。
-
名称中的HotSpot指的就是它的热点代码探测技术。
-
通过计数器找到最具编译价值代码,触发即时编译或栈上替换
-
通过编译器与解释器协同工作,在最优化的程序响应时间与最佳执行性能中取得平衡
-
- 专注于服务器端应用:它可以不太关注程序启动速度,因此JRockit内部不包含解析器实现,全部代码都靠即时编译器编译后执行。
- 大量的行业基准测试显示,
JRockit JVM是世界上最快的JVM
:使用JRockit产品,客户已经体验到了显著的性能提高(一些超过了70%)和硬件成本的减少(达50%)。 - 优势:全面的Java运行时解决方案组合
- JRockit面向延迟敏感型应用的解决方案JRockit Real Time提供以毫秒或微秒级的JVM响应时间,适合财务、军事指挥、电信网络的需要
- Mission Control服务套件,它是一组以极低的开销来监控、管理和分析生产环境中的应用程序的工具。
- 2008年,JRockit被Oracle收购。
- Oracle表达了整合两大优秀虚拟机的工作,大致在JDK8中完成。整合的方式是在HotSpot的基础上,移植JRockit的优秀特性。
- 高斯林:目前就职于谷歌,研究人工智能和水下机器人
- 全称:IBM Technology for Java Virtual Machine,简称IT4J,内部代号:J9
- 市场定位与HotSpot接近,服务器端、桌面应用、嵌入式等多用途VM广泛用于IBM的各种Java产品。
- 目前,
有影响力的三大商用虚拟机之一,也号称是世界上最快的Java虚拟机
。 - 2017年左右,IBM发布了开源J9VM,命名为openJ9,交给Eclipse基金会管理,也称为Eclipse OpenJ9
- OpenJDK -> 是JDK开源了,包括了虚拟机
- 由
AliJVM团队
发布。阿里,国内使用Java最强大的公司,覆盖云计算、金融、物流、电商等众多领域,需要解决高并发、高可用、分布式的复合问题。有大量的开源产品。 - 基于OpenJDK开发了自己的定制版本AlibabaJDK,简称AJDK。是整个阿里Java体系的基石。
- 基于OpenJDK Hotspot VM发布的国内第一个优化、深度定制且开源的高性能服务器版Java虚拟机。
- 创新的GCIH(GCinvisible heap)技术实现了off-heap,即将生命周期较长的Java对象从heap中移到heap之外,并且GC不能管理GCIH内部的Java对象,以此达到降低GC的回收频率和提升GC的回收效率的目的。
- GCIH中的对象还能够在多个Java虚拟机进程中实现共享
- 使用crc32指令实现JvM intrinsic降低JNI的调用开销
- PMU hardware的Java profiling tool和诊断协助功能
- 针对大数据场景的ZenGC
- taobao vm应用在阿里产品上性能高,硬件严重依赖inte1的cpu,损失了兼容性,但提高了性能
- 目前已经在淘宝、天猫上线,把Oracle官方JVM版本全部替换了。
- 具体JVM的内存结构,其实取决于其实现,不同厂商的JVM,或者同一厂商发布的不同版本,都有可能存在一定差异。
主要以Oracle HotSpot VM为默认虚拟机。