JDK源码分析系列之一：HashMap原理解析

最新推荐文章于 2024-08-01 15:05:06 发布

2401_84002730

最新推荐文章于 2024-08-01 15:05:06 发布

阅读量747

点赞数 29

分类专栏：程序员文章标签： java 哈希算法开发语言

本文链接：https://blog.csdn.net/2401_84002730/article/details/138231813

版权

程序员专栏收录该内容

195 篇文章 0 订阅

订阅专栏

本文详细解析了HashMap的put操作过程，包括hash碰撞处理、数组与链表/红黑树转换，以及HashMap的线程不安全性。同时强调了设计模式在开发中的重要性，特别是对于理解和维护代码结构。

摘要由CSDN通过智能技术生成

Node(int hash, K key, V value, Node<K,V> next) {

this.hash = hash;

this.key = key;

this.value = value;

this.next = next;

}

public final K getKey() { return key; }

public final V getValue() { return value; }

public final String toString() { return key + “=” + value; }

public final int hashCode() {

return Objects.hashCode(key) ^ Objects.hashCode(value);

}

public final V setValue(V newValue) {

V oldValue = value;

value = newValue;

return oldValue;

}

public final boolean equals(Object o) {

if (o == this)

return true;

if (o instanceof Map.Entry) {

Map.Entry<?,?> e = (Map.Entry<?,?>)o;

if (Objects.equals(key, e.getKey()) &&

Objects.equals(value, e.getValue()))

return true;

}

return false;

}

下图直观展示了HashMap在put操作过程中的数据机构的变化。由图可知，当发生hash碰撞时，会将新的节点追加到数组中，同时形成链表结构。当链表的大小超过8个时，为了提高查询效率，链表将转化为红黑树结构。利用红黑树快速增删改查的特点提高HashMap的性能，其中会用到红黑树的插入、删除、查找等算法。

这里写图片描述

HashMap中put操作的源码

public V put(K key, V value) {

//调用putVal方法，对key的hashCode做hash操作

return putVal(hash(key), key, value, false, true);

}

计算key的hash值，获取数组的索引。第一步获取hashCode值，再进行高位与运算，减少hash碰撞的几率。

static final int hash(Object key) {

int h;

return (key == null) ? 0 : (h = key.hashCode()) ^ (h >>> 16);

}

下面是HashMap中具体的插入操作，我们来分析一下具体的处理流程。

final V putVal(int hash, K key, V value, boolean onlyIfAbsent,

boolean evict) {

Node<K,V>[] tab; Node<K,V> p; int n, i;

//如果tab为空则创建

if ((tab = table) == null || (n = tab.length) == 0)

n = (tab = resize()).length;

//计算index

if ((p = tab[i = (n - 1) & hash]) == null)

tab[i] = newNode(hash, key, value, null);

else {

Node<K,V> e; K k;

//如果节点key存在，直接覆盖value

if (p.hash == hash &&

((k = p.key) == key || (key != null && key.equals(k))))

e = p;

//判断链表是否为红黑树

else if (p instanceof TreeNode)

e = ((TreeNode<K,V>)p).putTreeVal(this, tab, hash, key, value);

//如果为链表

else {

for (int binCount = 0; ; ++binCount) {

if ((e = p.next) == null) {

p.next = newNode(hash, key, value, null);

//如果链表的大小大于8，则转化为红黑树

if (binCount >= TREEIFY_THRESHOLD - 1) // -1 for 1st

treeifyBin(tab, hash);

break;

}

//key存在，则进行直接覆盖

if (e.hash == hash &&

((k = e.key) == key || (key != null && key.equals(k))))

break;

p = e;

}

if (e != null) { // existing mapping for key

V oldValue = e.value;

if (!onlyIfAbsent || oldValue == null)

e.value = value;

afterNodeAccess(e);

return oldValue;

}

++modCount;

//超过容量则进行扩容操作

if (++size > threshold)

resize();

afterNodeInsertion(evict);

return null;

}

public V get(Object key) {

Node<K,V> e;

return (e = getNode(hash(key), key)) == null ? null : e.value;

}

3.HashMap线程不安全性

我们都知道HashMap是线程不安全的，但是到底它具体哪个地方的操作会导致线程不安全。我们接下来具体分析一下，在多线程场景下，HashMap如何线程不安全。

从JDK1.8开始，HashMap的底层数据结构为Node<K,V>数组，即transient Node<K,V>[] table;。当发生hash碰撞时，数据会被追加到该Node<K,V>节点的链表中。冲突节点从链表头部插入，这样插入新entry时不需要遍历链表，时间复杂度为O(1)。

（1）在多线程场景下，如果同时有多个线程执行put操作，此时会有问题。我们从源码中可以得知，在put操作里面并没有进行加锁或者同步操作控制。这样会导致后面进行put操作的线程将前面执行完操作的数据覆盖掉。

这里写图片描述

（2）另外一点，我们可以发现resize()方法也没有进行同步操作。在默认的情况下，HashMap的容量为16，负载因子为0.75，也就是阈值为12，当阈值到达12时，它将自动进行扩容为原来的两倍。

final Node<K,V>[] resize() {

Node<K,V>[] oldTab = table;

int oldCap = (oldTab == null) ? 0 : oldTab.length;

int oldThr = threshold;

int newCap, newThr = 0;

if (oldCap > 0) {

//超过最大值则只能任其碰撞了

if (oldCap >= MAXIMUM_CAPACITY) {

threshold = Integer.MAX_VALUE;

return oldTab;

}

//没有超过最大值，则扩容为原来的两倍

else if ((newCap = oldCap << 1) < MAXIMUM_CAPACITY &&

oldCap >= DEFAULT_INITIAL_CAPACITY)

newThr = oldThr << 1; // double threshold

}

else if (oldThr > 0) // initial capacity was placed in threshold

newCap = oldThr;

else { // zero initial threshold signifies using defaults

newCap = DEFAULT_INITIAL_CAPACITY;

newThr = (int)(DEFAULT_LOAD_FACTOR * DEFAULT_INITIAL_CAPACITY);

}

//计算新的resize上限

if (newThr == 0) {

float ft = (float)newCap * loadFactor;

newThr = (newCap < MAXIMUM_CAPACITY && ft < (float)MAXIMUM_CAPACITY ?

(int)ft : Integer.MAX_VALUE);

}

threshold = newThr;

@SuppressWarnings({“rawtypes”,“unchecked”})

Node<K,V>[] newTab = (Node<K,V>[])new Node[newCap];

言尽于此，完结

无论是一个初级的 coder，高级的程序员，还是顶级的系统架构师，应该都有深刻的领会到设计模式的重要性。

第一，设计模式能让专业人之间交流方便，如下：

程序员A：这里我用了XXX设计模式

程序员B：那我大致了解你程序的设计思路了

第二，易维护

项目经理：今天客户有这样一个需求…

程序员：明白了，这里我使用了XXX设计模式，所以改起来很快

第三，设计模式是编程经验的总结

程序员A：B，你怎么想到要这样去构建你的代码

程序员B：在我学习了XXX设计模式之后，好像自然而然就感觉这样写能避免一些问题

第四，学习设计模式并不是必须的

程序员A：B，你这段代码使用的是XXX设计模式对吗？

程序员B：不好意思，我没有学习过设计模式，但是我的经验告诉我是这样写的

从设计思想解读开源框架，一步一步到Spring、Spring5、SpringMVC、MyBatis等源码解读，我都已收集整理全套，篇幅有限，这块只是详细的解说了23种设计模式，整理的文件如下图一览无余！

搜集费时费力，能看到此处的都是真爱！

要这样去构建你的代码

程序员B：在我学习了XXX设计模式之后，好像自然而然就感觉这样写能避免一些问题

第四，学习设计模式并不是必须的

程序员A：B，你这段代码使用的是XXX设计模式对吗？

程序员B：不好意思，我没有学习过设计模式，但是我的经验告诉我是这样写的

[外链图片转存中…(img-aTyu6lz1-1714140208471)]

[外链图片转存中…(img-XeQEffFH-1714140208472)]

搜集费时费力，能看到此处的都是真爱！

本文已被CODING开源项目：【一线大厂Java面试题解析+核心总结学习笔记+最新讲解视频+实战项目源码】收录

2401_84002730

关注

29
点赞
踩
27

收藏

觉得还不错? 一键收藏
0
评论
JDK源码分析系列之一：HashMap原理解析

Map.Entry)o;下图直观展示了HashMap在put操作过程中的数据机构的变化。由图可知，当发生hash碰撞时，会将新的节点追加到数组中，同时形成链表结构。当链表的大小超过8个时，为了提高查询效率，链表将转化为红黑树结构。利用红黑树快速增删改查的特点提高HashMap的性能，其中会用到红黑树的插入、删除、查找等算法。HashMap中put操作的源码//调用putVal方法，对key的hashCode做hash操作计算key的hash值，获取数组的索引。
复制链接

扫一扫