说一下HashSet和HashMap的底层实现及HashMap的put操作过程

最新推荐文章于 2024-07-17 10:09:49 发布

余飞军

最新推荐文章于 2024-07-17 10:09:49 发布

阅读量9.5k

点赞数 12

分类专栏： BAT面试题

本文链接：https://blog.csdn.net/u013030086/article/details/84976777

版权

本文详细介绍了哈希表的原理，包括HashSet依赖的HashMap实现，哈希冲突的解决策略，特别是HashMap的底层结构和put操作过程。文章指出，HashMap基于数组和链表（在JDK 1.8中引入红黑树）的数据结构，通过哈希函数映射元素，处理哈希冲突。此外，强调了在重写equals方法时，必须同时重写hashCode方法以确保正确性。

摘要由CSDN通过智能技术生成

java.lang.Object
int hashCode() 返回该对象的哈希码值。
boolean equals(Object obj) 指示某个其他对象是否与此对象“相等”。

一、概述

java最基本的两种数据结构：数组和链表，它们的区别：

数组易于快速读取（通过for循环），不便存储（数组长度有限制）；
链表易于存储，不易于快速读取。

哈希表的出现是为了解决链表访问不快速的弱点，哈希表也称散列表。HashSet是通过HasMap来实现的，HashMap的输入参数有Key、Value两个组成，在实现HashSet的时候，保持HashMap的Value为常量，相当于在HashMap中只对Key对象进行处理。
　　 HashMap的底层是一个数组结构，数组中的每一项对应了一个链表，这种结构称“链表散列”的数据结构，即数组和链表的结合体；也叫散列表、哈希表。

二、什么是哈希表

在讨论哈希表之前，我们先大概了解下其他数据结构在新增，查找等基础操作执行性能
　　**数组：**采用一段连续的存储单元来存储数据。对于指定下标的查找，时间复杂度为O(1)；通过给定值进行查找，需要遍历数组，逐一比对给定关键字和数组元素，时间复杂度为O(n)，当然，对于有序数组，则可采用二分查找，插值查找，斐波那契查找等方式，可将查找复杂度提高为O(logn)；对于一般的插入删除操作，涉及到数组元素的移动，其平均复杂度也为O(n)
　　**线性链表：**对于链表的新增，删除等操作（在找到指定操作位置后），仅需处理结点间的引用即可，时间复杂度为O(1)，而查找操作需要遍历链表逐一进行比对，复杂度为O(n)
　　**二叉树：**对一棵相对平衡的有序二叉树，对其进行插入，查找，删除等操作，平均复杂度均为O(logn)。
　　**哈希表：**相比上述几种数据结构，在哈希表中进行添加，删除，查找等操作，性能十分之高，不考虑哈希冲突的情况下，仅需一次定位即可完成，时间复杂度为O(1)，接下来我们就来看看哈希表是如何实现达到惊艳的常数阶O(1)的。
　　我们知道，数据结构的物理存储结构只有两种：顺序存储结构和链式存储结构（像栈，队列，树，图等是从逻辑结构去抽象的，映射到内存中，也这两种物理组织形式），而在上面我们提到过，在数组中根据下标查找某个元素，一次定位就可以达到，哈希表利用了这种特性，哈希表的主干就是数组。
　　比如我们要新增或查找某个元素，我们通过把当前元素的关键字，通过某个函数映射到数组中的某个位置，通过数组下标一次定位就可完成操作。
　　　　　　　　存储位置= f(关键字)
　　其中，这个函数f一般称为哈希函数，这个函数的设计好坏会直接影响到哈希表的优劣。举个例子，比如我们要在哈希表中执行插入操作：
　　在这里插入图片描述
　　查找操作同理，先通过哈希函数计算出实际存储地址，然后从数组中对应地址取出即可。

哈希冲突

然而万事无完美，如果两个不同的元素，通过哈希函数得出的实际存储地址相同怎么办？也就是说，当我们对某个元素进行哈希运算，得到一个存储地址，然后要进行插入的时候，发现已经被其他元素占用了，其实这就是所谓的哈希冲突，也叫哈希碰撞。前面我们提到过，哈希函数的设计至关重要，好的哈希函数会尽可能地保证
　　计算简单和散列地址分布均匀,但是，我们需要清楚的是，数组是一块连续的固定长度的内存空间，再好的哈希函数也不能保证得到的存储地址绝对不发生冲突。那么哈希冲突如何解决呢？哈希冲突的解决方案有多种:开放定址法（发生冲突，继续寻找下一块未被占用的存储地址），再散列函数法，链地址法，而HashMap即是采用了链地址法，也就是数组+链表的方式。

三、HashMap实现原理

HashMap的主干是一个Entry数组。Entry是HashMap的基本组成单元，每一个Entry包含一个key-value键值对。

//HashMap的主干数组，可以看到就是一个Entry数组，初始值为空数组{}，主干数组的长度一定是2的次幂，至于为什么这么做，后面会有详细分析。
transient Entry[] table = (Entry[]) EMPTY_TABLE;

Entry是HashMap中的一个静态内部类。代码如下

static class Entry implements Map.Entry {
        final K key;
        V value;
        Entry next;//存储指向下一个Entry的引用，单链表结构
        int hash;//对key的hashcode值进行hash运算后得到的值，存储在Entry，避免重复计算       
        Entry(int h, K k, V v, Entry n) {
            value = v;
            next = n;
            key = k;
            hash = h;
        }

所以，HashMap的整体结构如下

最低0.47元/天解锁文章

余飞军

关注

12
点赞
踩
37

收藏

觉得还不错? 一键收藏
5
评论
说一下HashSet和HashMap的底层实现及HashMap的put操作过程

说一下HashSet和HashMap的底层实现及HashMap的put操作过程一、概述二、什么是哈希表哈希冲突三、HashMap实现原理四、为何HashMap的数组长度一定是2的次幂？五、重写equals方法需同时重写hashCode方法七、JDK 1.8的改变java.lang.Objectint hashCode() 返回该对象的哈希码值。boolean equals(Objec...
复制链接

扫一扫