代码随想录算法训练营第6天|LeetCode242. 有效的字母异位词、LeetCode349. 两个数组的交集、LeetCode202.快乐数、LeetCode1.两数之和
今天开始进入哈希表章节了。
1、哈希表理论基础
哈希表Hash table
定义:哈希表是根据关键码的值而直接进行访问的数据结构。
举例:数组,关键码就是数组的索引下标。
作用:用来快速判断一个元素是否出现集合里。
哈希函数hash function
情景:要找一个学生是否在这所学校里,需要初始化把这所学校里学生的名字都存在哈希表里,在查询的时候通过索引直接就可以知道这位同学在不在这所学校里了。
哈希函数:把学生的姓名直接映射为哈希表上的索引,然后就可以通过查询索引下标快速知道这位同学是否在这所学校里了。
转换:如下图所示,通过hashCode把名字转化为数值,一般hashcode是通过特定编码方式,可以将其他数据格式转化为不同的数值,这样就把学生名字映射为哈希表上的索引数字了。
为了保证映射出来的索引数值都落在哈希表上,我们会在再次对数值做一个取模的操作,这样我们就保证了学生姓名一定可以映射到哈希表上了。
哈希碰撞
学生的数量大于哈希表的大小怎么办,此时就算哈希函数计算的再均匀,也避免不了会有几位学生的名字同时映射到哈希表 同一个索引下标的位置。即出现了哈希碰撞。
拉链法
小李和小王在索引1的位置发生了冲突,发生冲突的元素都被存储在链表中。 这样我们就可以通过索引找到小李和小王。
拉链法就是要选择适当的哈希表的大小,这样既不会因为数组空值而浪费大量内存,也不会因为链表太长而在查找上浪费太多时间。
线性探测法
使用线性探测法,一定要保证tableSize大于dataSize。 我们需要依靠哈希表中的空位来解决碰撞问题。
例如冲突的位置,放了小李,那么就向下找一个空位放置小王的信息。所以要求tableSize一定要大于dataSize ,要不然哈希表上就没有空置的位置来存放 冲突的数据了。
常见的三种哈希结构
们想使用哈希法来解决问题的时候,我们一般会选择如下三种数据结构。
- 数组:当数值范围较小时
- set (集合):数值范围跨度大的时候
- map(映射):存储两个值的时候(key,value)
set
std::unordered_set
底层实现为哈希表,std::set 和std::multiset
的底层实现是红黑树,红黑树是一种平衡二叉搜索树,所以key值是有序的,但key不可以修改,改动key值会导致整棵树的错乱,所以只能删除和增加。
虽然std::set
、std::multiset
的底层实现是红黑树,不是哈希表,std::set
、std::multiset
使用红黑树来索引和存储,不过给我们的使用方式,还是哈希法的使用方式,即key和value。所以使用这些数据结构来解决映射问题的方法,我们依然称之为哈希法。
map
std::unordered_map
底层实现为哈希表,std::map
和std::multimap
的底层实现是红黑树。同理,std::map
和std::multimap
的key也是有序的(这个问题也经常作为面试题,考察对语言容器底层的理解)。
在map 是一个key value 的数据结构,map中,对key是有限制,对value没有限制的,因为key的存储方式使用红黑树实现的。
使用
当我们要使用集合来解决哈希问题的时候,优先使用unordered_set,因为它的查询和增删效率是最优的,如果需要集合是有序的,那么就用set,如果要求不仅有序还要有重复数据的话,那么就用multiset。
总结
当我们遇到了要快速判断一个元素是否出现集合里的时候,就要考虑哈希法。
但是哈希法也是牺牲了空间换取了时间,因为我们要使用额外的数组,set或者是map来存放数据,才能实现快速的查找。
如果在做面试题目的时候遇到需要判断一个元素是否出现过的场景也应该第一时间想到哈希法!!!
2、LeetCode242. 有效的字母异位词
题目:242. 有效的字母异位词 - 力扣(LeetCode)
文章:代码随想录 (programmercarl.com)
视频:学透哈希表,数组使用有技巧!Leetcode:242.有效的字母异位词_哔哩哔哩_bilibili
本题使用数组。因为题目限制了数值的大小。
没时间直接看题解。
字母异位词:即两个字符串由相同的字母组成,但是字母的位置不要求相同。如abbc和bbac。
题解
思路:定义一个数组记录每个字母出现的次数。a-z26个字母因此数组大小为26。
代码
时间复杂度为O(n),空间上因为定义是的一个常量大小的辅助数组,所以空间复杂度为O(1)。
bool isAnagram(string s, string t) {
//数组
int hash[26]={0};
//遍历第一个字符串
for(int i=0;i<s.size();i++){
hash[s[i] - 'a']++;
}
//遍历第二个
for(int i=0;i<t.size();i++){
hash[t[i] - 'a']--;
}
//判断是否均为0
for(int i=0;i<26;i++){
if(hash[i] != 0)
return false;
}
return true;
}
3、LeetCode349. 两个数组的交集
题目:349. 两个数组的交集 - 力扣(LeetCode)
文章:代码随想录 (programmercarl.com)
视频:学透哈希表,set使用有技巧!Leetcode:349. 两个数组的交集_哔哩哔哩_bilibili
本题主要学会使用unordered_set。
注意题目特意说明:输出结果中的每个元素一定是唯一的,也就是说输出的结果的去重的, 同时可以不考虑输出结果的顺序。
思路
先把两个数组去重。遍历数组1,将其哈希值放进哈希表中,再遍历数组2看是否存在,存在则放进result中。
set解决
默认数值很大,采用set。但力扣后面改题改了值的限制,更改之后用数组更好。这里的题解只是为了学会用set。
result选择unordered_set,效率最高,取值最高。会自动去重。
选择合适的数据结构是非常重要的!!!
代码:
注意:unordered_set<int> nums_set(nums1.begin(), nums1.end());
可以这样进行初始化!!!
unordered_set<int> result_set; // 存放结果,之所以用set是为了给结果集去重
unordered_set<int> nums_set(nums1.begin(), nums1.end());
for (int num : nums2) {
// 发现nums2的元素 在nums_set里又出现过
if (nums_set.find(num) != nums_set.end()) {
result_set.insert(num);//插入
}
}
return vector<int>(result_set.begin(), result_set.end());
4、LeetCode202.快乐数
题解
使用哈希法,来判断这个sum是否重复出现,如果重复了就是return false, 否则一直找到sum为1为止。
判断sum是否重复出现就可以使用unordered_set。使用find()函数
代码
犯错:计算平方的时候写成了sum += (n%10)^2。C++,^
符号不表示指数运算,而是按位异或(XOR)运算符。
注意:查找的函数find()和插入函数insert()
int getSum(int n){
int sum=0;
while(n){
sum += (n%10)*(n%10);
n = n/10;
}
return sum;
}
bool isHappy(int n) {
int sum;
unordered_set<int> s;
while(1){
sum = getSum(n);
if(sum == 1)
return true;
if(s.find(sum) != s.end()){//循环
return false;
}
else
s.insert(sum);
n = sum;
}
}
- 时间复杂度: O(logn)
- 空间复杂度: O(logn
5、LeetCode1.两数之和
题目:1. 两数之和 - 力扣(LeetCode)
文章:代码随想录 (programmercarl.com)
视频:梦开始的地方,Leetcode:1.两数之和,学透哈希表,map使用有技巧!_哔哩哔哩_bilibili
第一想法
暴力枚举,两个for
vector<int> twoSum(vector<int>& nums, int target) {
//法1 map
// unordered_map<int, int> m;
// for(int i=0;i< nums.size(); i++){
// int s = target - nums[i];
// if(m.find(s) != m.end()){
// return{m[s], i};
// }
// //记得插入
// m.insert({nums[i], i});
// }
// return {};
//法2 暴力枚举法
for(int i=0; i<nums.size(); i++){
for(int j=i-1; j>=0 ;j--){
if(nums[i] + nums[j] == target)
return{i,j};
}
}
return {};
}
题解
思路:使用哈希法解决,由于要存放两个元素(元素,下标),数组和set都不行,因此使用unordered_map,对应于(key,value)。
原因:遍历一个元素的时候要存放之前遍历过的元素。比如当前元素为3,则要找之前是否遍历过元素6。因此使用哈希法。
map:存放遍历过的元素
代码
vector<int> twoSum(vector<int>& nums, int target) {
unordered_map<int, int> m;
for(int i=0;i< nums.size(); i++){
int s = target - nums[i];
if(m.find(s) != m.end()){
return{m[s], i};
}
//记得插入
m.insert({nums[i], i});
}
return {};
}
总结
- 为什么想到用哈希法
- 为什么用map,unordered_map
- map的作用是什么
- map的key存什么,value存什么
总结
- unordered_set的用法:初始化、查找find()、增加insert()
- unordered_map的用法:插入insert()、查找find()
- 数组使用:当数值范围较小时
- set使用:当数值较大,或者数值分布很散的时候(如1,5,10000)
- map使用:当要存两个值的时候(key, value)