面试及源码解析的一个高质量工程哦,不信你点我进去看一看,欢迎靓仔一键三联~
一、HashSet
1.1 介绍
java.util.HashSet
是Set
接口的一个实现类,它所存储的元素是不可重复的,并且元素都是无序的(即存取顺序不一致)。java.util.HashSet
底层的实现其实是一个java.util.HashMap
支持。
HashSet是根据对象的哈希值来确定元素在集合中的存储位置,因此具有良好的存取和查找性能。保证元素唯一性的方式依赖于:
hashCode与
equals`方法。
1.2 特点
- 不能保证元素的顺序,元素是无序的
- HashSet不是同步的,需要外部保持线程之间的同步问题
- 集合元素值允许为null
二、HashSet集合存储数据的结构(哈希表)
2.1 什么是哈希表呢?
在JDK1.8之前,哈希表底层采用数组+链表实现,即使用链表处理冲突,同一hash值的链表都存储在一个链表里。但是当位于一个桶中的元素较多,即hash值相等的元素较多时,通过key值依次查找的效率较低。而JDK1.8中,哈希表存储采用数组+链表+红黑树实现,当链表长度超过阈值(8)时,将链表转换为红黑树,这样大大减少了查找时间。
简单的来说,哈希表是由数组+链表+红黑树(JDK1.8增加了红黑树部分)实现的,如下图所示。
方便理解,请看下面这幅存储流程图
**JDK1.8**引入红黑树大程度优化了HashMap的性能,那么对于我们来讲保证HashSet集合元素的唯一,其实就是根据对象的hashCode和equals方法来决定的。如果我们往集合中存放自定义的对象,那么保证其唯一,就必须复写hashCode和equals方法建立属于当前对象的比较方式。
三、HashSet的数据结构
java.lang.Object
------> java.util.AbstractCollection<E>
-------> java.util.AbstractSet<E>
--------> java.util.HashSet<E>
3.1实现的接口
Serializable, Cloneable, Iterable<E>, Collection<E>, Set<E>
3.2 基本属性
private transient HashMap<E,Object> map; //map集合,HashSet存放元素的容器
private static final Object PRESENT = new Object(); //map,中键对应的value值
3.3 构造方法
//无参构造方法,完成map的创建
public HashSet() {
map = new HashMap<>();
}
//指定集合转化为HashSet, 完成map的创建
public HashSet(Collection<? extends E> c) {
map = new HashMap<>(Math.max((int) (c.size()/.75f) + 1, 16));
addAll(c);
}
//指定初始化大小,和负载因子
public HashSet(int initialCapacity, float loadFactor) {
map = new HashMap<>(initialCapacity, loadFactor);
}
//指定初始化大小
public HashSet(int initialCapacity) {
map = new HashMap<>(initialCapacity);
}
//指定初始化大小和负载因子,dummy 无实际意义
HashSet(int initialCapacity, float loadFactor, boolean dummy) {
map = new LinkedHashMap<>(initialCapacity, loadFactor);
}
tips: 通过构造函数,不难发现,HashSet的底层是采用HashMap实现的
//add()
public boolean add(E e) {
return map.put(e, PRESENT)==null;
}
PRESENT为HashSet类中定义的一个使用static final 修饰的常量,并无实际的意义,HashSet的add方法调用HashMap的put()方法实现,如果键已经存在,HashMap.put()放回的是旧值,添加失败,如果添加成功map.put()方法返回的是null ,HashSet.add()方法返回true,要添加的元素作为可map中的key 。
//remove()
public boolean remove(Object o) {
return map.remove(o)==PRESENT;
}
删除方法,调用map.remove()方法实现,map.remove()能找到指定的key,则返回key对应的value,对于Hashset而言,它所有的key对应的值都是PRESENT。
四、完整版源码解析
public class HashSet<E>
extends AbstractSet<E>
implements Set<E>, Cloneable, java.io.Serializable
{
static final long serialVersionUID = -5024744406713321676L; //序列化版本号
private transient HashMap<E,Object> map; //HashMap变量,用于存放HashSet的值
private static final Object PRESENT = new Object(); //map中的值
//构造方法
public HashSet() {
map = new HashMap<>();
}
//构造方法,将指定的集合转化为HashSet
public HashSet(Collection<? extends E> c) {
map = new HashMap<>(Math.max((int) (c.size()/.75f) + 1, 16));
addAll(c);
}
//构造方法,指定初始化的大小和负载因子
public HashSet(int initialCapacity, float loadFactor) {
map = new HashMap<>(initialCapacity, loadFactor);
}
//指定初始化大小
public HashSet(int initialCapacity) {
map = new HashMap<>(initialCapacity);
}
//构造方法,采用default修饰,只能是同一个包下的成员访问。包不相同无法访问
HashSet(int initialCapacity, float loadFactor, boolean dummy) {
map = new LinkedHashMap<>(initialCapacity, loadFactor);
}
//HashSet的遍历操作
//通过这个方法可以发现,HashSet调用了HashMap存放,因为HashSet并不是键值对存储,所以它只是把它的值做了Map中的键,在遍历HashSet的集合元素时,实际上是遍历的Map中Key的集合。
public Iterator<E> iterator() {
return map.keySet().iterator();
}
//返回集合中元素的容量
public int size() {
return map.size();
}
//判断是否为空
public boolean isEmpty() {
return map.isEmpty();
}
//是否包含指定的元素
public boolean contains(Object o) {
return map.containsKey(o);
}
//添加元素,添加的元素作为了Map中的key,value使用了一个常量表示
public boolean add(E e) {
return map.put(e, PRESENT)==null;
}
//删除元素
public boolean remove(Object o) {
return map.remove(o)==PRESENT;
}
//清空集合
public void clear() {
map.clear();
}
//克隆方法
public Object clone() {
try {
HashSet<E> newSet = (HashSet<E>) super.clone();
newSet.map = (HashMap<E, Object>) map.clone();
return newSet;
} catch (CloneNotSupportedException e) {
throw new InternalError();
}
}
//写入输出流操作。
private void writeObject(java.io.ObjectOutputStream s)
throws java.io.IOException {
// Write out any hidden serialization magic
s.defaultWriteObject();
// Write out HashMap capacity and load factor
s.writeInt(map.capacity());
s.writeFloat(map.loadFactor());
// Write out size
s.writeInt(map.size());
// Write out all elements in the proper order.
for (E e : map.keySet())
s.writeObject(e);
}
//从输入流中读取对象
private void readObject(java.io.ObjectInputStream s)
throws java.io.IOException, ClassNotFoundException {
// Read in any hidden serialization magic
s.defaultReadObject();
// Read in HashMap capacity and load factor and create backing HashMap
int capacity = s.readInt();
float loadFactor = s.readFloat();
map = (((HashSet)this) instanceof LinkedHashSet ?
new LinkedHashMap<E,Object>(capacity, loadFactor) :
new HashMap<E,Object>(capacity, loadFactor));
// Read in size
int size = s.readInt();
// Read in all elements in the proper order.
for (int i=0; i<size; i++) {
E e = (E) s.readObject();
map.put(e, PRESENT);
}
}
}
(HashSet的底层实现和HashMap使用的是相同的方式,因为Map是无序的,因此HashSet也无法保证顺序。HashSet的方法也是借助HashMap的方法来实现的。)
五、为什么HashMap链表长度超过8会转成树结构?
HashMap在JDK1.8及以后的版本中引入了红黑树结构,(红黑树属于平衡二叉树)若桶中链表元素个数大于等于8时,链表转换成树结构;若桶中链表元素个数小于等于6时,树结构还原成链表。因为红黑树的平均查找长度是log(n),长度为8的时候,平均查找长度为3,如果继续使用链表,平均查找长度为8/2=4,这才有转换为树的必要。链表长度如果是小于等于6,6/2=3,虽然速度也很快的,但是转化为树结构和生成树的时间并不会太短。
还有选择6和8,中间有个差值7可以有效防止链表和树频繁转换。假设一下,如果设计成链表个数超过8则链表转换成树结构,链表个数小于8则树结构转换成链表,如果一个HashMap不停的插入、删除元素,链表个数在8左右徘徊,就会频繁的发生树转链表、链表转树,效率会很低。
【解析】
红黑树插入为O(lgn),查询为O(lgn),链表插入为O(1),查询为O(n)。个数少时,插入删除成本高,用链表;个数多时,查询成本高,用红黑树。需要定一个值,比这个值大就转红黑树,比这个值小就转链表,而且要避免频繁的转换。根据泊松分布,在负载因子0.75(HashMap默认)的情况下,单个hash槽内元素个数为8的概率小于百万分之一,将7作为一个分水岭,等于7时不做转换,大于等于8才转红黑树,小于等于6才转链表。
TreeNodes占用空间是普通Nodes的两倍,所以只有当bin包含足够多的节点时才会转成TreeNodes,而是否足够多就是由TREEIFY_THRESHOLD的值决定的。当bin中节点数变少时,又会转成普通的bin。并且我们查看源码的时候发现,链表长度达到8就转成红黑树,当长度降到6就转成普通bin。
这样就解释了为什么不是一开始就将其转换为TreeNodes,而是需要一定节点数才转为TreeNodes,就是因为trade-off,空间和时间的权衡:
【tips】由链表变成红黑树也只是当前桶挂载的bin会进行转换,不会影响其它桶的数据结构
【拓展】
1.平衡二叉搜索树(AVL):平衡二叉树或为空树,或为如下性质的二叉排序树:
左右子树深度之差的绝对值不超过1;
左右子树仍然为平衡二叉树.
2.一般的,红黑树,满足以下性质,即只有满足以下全部性质的树,我们才称之为红黑树:
每个结点要么是红的,要么是黑的。
根结点是黑的。
每个叶结点,即空结点(NIL)是黑的[注意:这里叶子节点,是指为空(NIL)的叶子节点!]。
如果一个结点是红的,那么它的俩个儿子都是黑的。
对每个结点,从该结点到其子孙结点的所有路径上包含相同数目的黑结点
感谢以下大佬的助攻
源码解析
https://blog.csdn.net/weixin_33877092/article/details/86730865
红黑树
https://www.jianshu.com/p/30afcf59828f