LeetCode
前K个高频单词
给一非空的单词列表,返回前 k 个出现次数最多的单词。
返回的答案应该按单词出现频率由高到低排序。如果不同的单词有相同出现频率,按字母顺序排序。
示例 1:
输入: ["i", "love", "leetcode", "i", "love", "coding"], k = 2
输出: ["i", "love"]
解析: "i" 和 "love" 为出现次数最多的两个单词,均为2次。
注意,按字母顺序 "i" 在 "love" 之前。
示例 2:
输入: ["the", "day", "is", "sunny", "the", "the", "the", "sunny", "is", "is"], k = 4
输出: ["the", "is", "sunny", "day"]
解析: "the", "is", "sunny" 和 "day" 是出现次数最多的四个单词,
出现次数依次为 4, 3, 2 和 1 次。
解法:大根堆
解题思路:
用一个大根堆保存每一个单词就可以了,只要重写一下优先队列的比较器就可以
class Solution {
public ArrayList<String> topKFrequent(String[] words, int k) {
HashMap<String,Integer> map = new HashMap<String,Integer>();
ArrayList<String> res = new ArrayList<String>();
for(String s: words)
map.put(s,map.getOrDefault(s, 0)+1);
PriorityQueue<String> pq = new PriorityQueue<>(
new Comparator<String>(){
public int compare(String a, String b)
{
return map.get(a).equals(map.get(b))?a.compareTo(b):map.get(b)-map.get(a);
}
});
for(String key: map.keySet())
pq.offer(key);
for(int i=0; i<k; i++)
{
res.add(pq.peek());
pq.poll();
}
return res;
}
}
感想
感觉堆的问题基本上就是Top-K问题