双重检查锁定与延迟初始化
在Java多线程程序中,有时候需要采用延迟初始化来降低初始化类和创建对象的开销。双
重检查锁定是常见的延迟初始化技术,但它是一个错误的用法。本文将分析双重检查锁定的
错误根源,以及两种线程安全的延迟初始化方案。
下面是非线程安全的延迟初始化对象的示例代码
public class UnsafeLazyInitialization {
private static Instance instance=null;
public static Instance getInstance() {
if (instance ==null){
instance=new Instance();
}
return instance;
}
}
class Instance{
private String title="单身贵族";
}
对于UnsafeLazyInitialization类,我们可以对getInstance()方法做同步处理来实现线程安全
的延迟初始化。示例代码如下。
public class SafeLazyInitialization {
private static Instance instance=null;
public synchronized static Instance getInstance() {
if(instance==null){
instance=new Instance();
}
return instance;
}
}
由于对getInstance()方法做了同步处理,synchronized将导致性能开销。如果getInstance()方
法被多个线程频繁的调用,将会导致程序执行性能的下降。反之,如果getInstance()方法不会被
多个线程频繁的调用,那么这个延迟初始化方案将能提供令人满意的性能。
在早期的JVM中,synchronized(甚至是无竞争的synchronized)存在巨大的性能开销。因此,
人们想出了一个“聪明”的技巧:双重检查锁定(Double-Checked Locking)。人们想通过双重检查
锁定来降低同步的开销。下面是使用双重检查锁定来实现延迟初始化的示例代码。
public class DoubleCheckLock { //1
private static Instance instance=null; //2
public static Instance getInstance() { //3
if(instance==null){ //4第一次检查
synchronized (DoubleCheckLock.class){//5加锁
if(instance==null){ //6第二次检查
instance=new Instance(); //7问题的根源出在这里
} //8
} //9
} //10
return instance; //11
}
}
如上面代码所示,如果第一次检查instance不为null,那么就不需要执行下面的加锁和初始
化操作。因此,可以大幅降低synchronized带来的性能开销。上面代码表面上看起来,似乎两全
其美。
·多个线程试图在同一时间创建对象时,会通过加锁来保证只有一个线程能创建对象。
·在对象创建好之后,执行getInstance()方法将不需要获取锁,直接返回已创建好的对象。
双重检查锁定看起来似乎很完美,但这是一个错误的优化! 在线程执行到第4行,代码读
取到instance不为null时,instance引用的对象有可能还没有完成初始化
问题的根源
前面的双重检查锁定示例代码的第7行(instance=new Singleton();)创建了一个对象。这一
行代码可以分解为如下的3行伪代码。
memory = allocate(); ctorInstance(memory); instance = memory; | // 1:分配对象的内存空间 // 2:初始化对象 // 3:设置instance指向刚分配的内存地址 |
上面3行伪代码中的2和3之间,可能会被重排序(在一些JIT编译器上,这种重排序是真实发生的
memory = allocate(); // 1:分配对象的内存空间
instance = memory; // 3:设置instance指向刚分配的内存地址
// 注意,此时对象还没有被初始化!
ctorInstance(memory); // 2:初始化对象
intra-thread semantics保证重排序不会
改变单线程内的程序执行结果。换句话说,intra-thread semantics允许那些在单线程内,不会改
变单线程程序执行结果的重排序。上面3行伪代码的2和3之间虽然被重排序了,但这个重排序
并不会违反intra-thread semantics。这个重排序在没有改变单线程程序执行结果的前提下,可以
提高程序的执行性能
DoubleCheckedLocking示例代码的第7行(instance=new Singleton();)如果发生重排序,另一个并发执行的线程B就有可能在第4行判断instance不为null。线程B接下来将访问instance所引用的对象,但此时这个对象可能还没有被A线程初始化!
DoubleCheckedLocking示例代码的第7行(instance=new Singleton();)如果
发生重排序,另一个并发执行的线程B就有可能在第4行判断instance不为null。线程B接下来将
访问instance所引用的对象,但此时这个对象可能还没有被A线程初始化!
1.基于volatile的解决方案
对于前面的基于双重检查锁定来实现延迟初始化的方案(指DoubleCheckedLocking示例代
码),只需要做一点小的修改(把instance声明为volatile型),就可以实现线程安全的延迟初始
化。请看下面的示例代码。
public class DoubleCheckLock { //1
private volatile static Instance instance=null; //2
public static Instance getInstance() { //3
if(instance==null){ //4第一次检查
synchronized (DoubleCheckLock.class){//5加锁
if(instance==null){ //6第二次检查
instance=new Instance();
} //8
} //9
} //10
return instance; //11
}
}
注意 这个解决方案需要JDK 5或更高版本(因为从JDK 5开始使用新的JSR-133内存模
型规范,这个规范增强了volatile的语义)。
当声明对象的引用为volatile后,上面的3行伪代码中的2和3之间的重排序,在多线程
环境中将会被禁止
这个方案本质上是通过禁止图的2和3之间的重排序,来保证线程安全的延迟初始化
二、基于类初始化的解决方案
JVM在类的初始化阶段(即在Class被加载后,且被线程使用之前),会执行类的初始化。在执行类的初始化期间,JVM会去获取一个锁。这个锁可以同步多个线程对同一个类的初始化。
基于这个特性,可以实现另一种线程安全的延迟初始化方案(这个方案被称之为
Initialization On Demand Holder idiom)。
public class InstanceFactory {
private static class InstanceHolder{
public static Instance instance=new Instance();
}
public static Instance getInstance(){
return InstanceHolder.instance;//这里将导致instance被初始化
}
}
这个方案的实质是:允许的3行伪代码中的2和3重排序,但不允许非构造线程(这
里指线程B)“看到”这个重排序。
初始化一个类,包括执行这个类的静态初始化和初始化在这个类中声明的静态字段。根
据Java语言规范,在首次发生下列任意一种情况时,一个类或接口类型T将被立即初始化。
1)T是一个类,而且一个T类型的实例被创建。
2)T是一个类,且T中声明的一个静态方法被调用。
3)T中声明的一个静态字段被赋值。
4)T中声明的一个静态字段被使用,而且这个字段不是一个常量字段。
5)T是一个顶级类(Top Level Class,见Java语言规范的§7.6),而且一个断言语句嵌套在T
内部被执行。
在InstanceFactory示例代码中,首次执行getInstance()方法的线程将导致InstanceHolder类被
初始化(符合情况4)。
由于Java语言是多线程的,多个线程可能在同一时间尝试去初始化同一个类或接口(比如
这里多个线程可能在同一时刻调用getInstance()方法来初始化InstanceHolder类)。
总结
通过对比基于volatile的双重检查锁定的方案和基于类初始化的方案,我们会发现基于类
初始化的方案的实现代码更简洁。但基于volatile的双重检查锁定的方案有一个额外的优势:
除了可以对静态字段实现延迟初始化外,还可以对实例字段实现延迟初始化。
字段延迟初始化降低了初始化类或创建实例的开销,但增加了访问被延迟初始化的字段
的开销。在大多数时候,正常的初始化要优于延迟初始化。如果确实需要对实例字段使用线程
安全的延迟初始化,请使用上面介绍的基于volatile的延迟初始化的方案;如果确实需要对静
态字段使用线程安全的延迟初始化,请使用上面介绍的基于类初始化的方案。
参考资料 并发编程的艺术