前k个高频词

https://leetcode.cn/problems/top-k-frequent-words/

给定一个单词列表 words 和一个整数 k ,返回前 k 个出现次数最多的单词。

返回的答案应该按单词出现频率由高到低排序。如果不同的单词有相同出现频率, 按字典顺序 排序。

示例 1:

输入: words = ["i", "love", "leetcode", "i", "love", "coding"], k = 2

输出: ["i", "love"]

解析: "i" 和 "love" 为出现次数最多的两个单词,均为2次。

注意,按字母顺序 "i" 在 "love" 之前。

示例 2:

输入: ["the", "day", "is", "sunny", "the", "the", "the", "sunny", "is", "is"], k = 4

输出: ["the", "is", "sunny", "day"]

解析: "the", "is", "sunny" 和 "day" 是出现次数最多的四个单词,

出现次数依次为 4, 3, 2 和 1 次。

注意:

1 <= words.length <= 500

1 <= words[i] <= 10

words[i] 由小写英文字母组成。

k 的取值范围是 [1, 不同 words[i] 的数量]

思路

解题思路

​ 本题和前k个高频元素的小顶堆实现有点像,可以参考着做。首先我们需要先统计words中每个元素出现的次数,建立一个hashmap

很自然的,我们希望对这个hashmap进行排序,最好是按值排序,这样问题就解决了。

​ 但是,unordered_map本身是无序的,不支持排序。因此在统计完对应元素出现的次数之后,我们还需要将键值对取出,放入另外的支持排序的数据结构中进行排序处理

​ 并且,由于题目的要求,我们需要自定义排序规则(编写仿函数cmp)。可以选择vector作为排序的容器载体,使用值按从大到小完成排序之后,返回k个pair的first(键)即可

排序仿函数编写

​ 注意,这里我们在编写cmp时要满足两个规则:vector中元素按值从大到小降序排序、如果值相等则按照键的字典序大小进行排序

​ 在 bool operator() 函数中,它根据给定的规则比较了两个 pair<string, int> 类型的对象 p1 和 p2。其中,p1.second 表示字符串 p1 出现的次数,p1.first 表示字符串本身。函数返回值为 true 表示 p1 在排序中应该出现在 p2 的前面,而返回值为 false 则表示 p1 应该出现在 p2 的后面。

​ 这里不能直接使用 return p1.second > p2.second; 是因为如果有多个字符串的出现次数相同,则需要按字典序升序排列字符串,即在出现次数相同的情况下,需要同时比较字符串的大小。因此,我们需要在重载函数中加入额外的比较操作来满足题目的要求。

​ 具体来说,重载函数首先比较两个 pair<string, int> 中的出现次数,如果出现次数不同,则将出现次数多的字符串排在前面;如果出现次数相同,则比较两个字符串的字典序,将字典序小的字符串排在前面。综合这两种比较规则,就能够得到题目所要求的排序结果。

什么是字典序?

字典序(Lexicographic Order)是一种字符串之间的大小比较方式,也可以称为字母表顺序、字母表序或词典序。在字典序中,字符串的大小关系取决于它们每个位置上的字符的 ASCII 码值的大小关系。具体来说,给定两个字符串 s 和 t,如果从左到右逐位比较它们对应位置上的字符,遇到不同的字符时,则以这两个字符的 ASCII 码值的大小关系来确定它们之间的大小关系,如下所示:

  1. 如果 s[i] < t[i],则 s 小于 t;
  2. 如果 s[i] > t[i],则 s 大于 t;
  3. 如果 s[i] = t[i],则继续比较下一个字符,直到找到一个不同的字符或者比较完整个字符串。

举例来说,"abc" 小于 "acd",因为在第 2 个位置处 'b' 的 ASCII 码值小于 'c' 的 ASCII 码值。类似地,"apple" 小于 "application",因为前者长度较短,而在前 5 个字符处与后者相同,因此按照字典序规则,前者排在后者前面。

在实际编程中,我们通常会用到 operator< 操作符来实现字符串之间的字典序比较。例如,对于两个字符串 s 和 t,可以使用 s < t 来判断它们的大小关系。

代码

// 定义一个Solution类
class Solution {
public:
// 定义一个嵌套类cmp用于排序
class cmp{
public:
// 重载()运算符,用于比较两个pair<string, int>类型的对象
bool operator()(pair<string, int>& p1, pair<string, int>& p2){
// 按pair值比较,如果p1.second大于p2.second,则返回true,否则返回false
if(p1.second != p2.second) return p1.second > p2.second;
// 按pair键比较,如果p1.second等于p2.second(出现次数相等),则按字典序比较p1.first和p2.first,如果p1.first小于p2.first,则返回true,否则返回false
else return p1.first < p2.first;
}
};
vector<string> topKFrequent(vector<string>& words, int k) {
unordered_map<string, int> hashmap;// 定义一个unordered_map,用于统计每个字符串在words中出现的次数
for(int i = 0; i < words.size(); ++i) hashmap[words[i]]++; // 将哈希表中的键值对转换成pair<string, int>类型的vector,以便排序
vector<pair<string, int>> vec4sort(hashmap.begin(), hashmap.end());
// 使用自定义的cmp类进行排序,按照字符串出现的次数进行降序排序,如果次数相同则按字典序升序排序
sort(vec4sort.begin(), vec4sort.end(), cmp()); vector<string> res;// 定义一个空的vector<string>,用于存储结果
// 将排序后的前k个pair<string, int>中的string添加到res中
for(int i = 0; i < k; ++i){
res.push_back(vec4sort[i].first);
}
return res;// 返回结果向量
}
};

【LeetCode哈希表】前k个高频词,利用哈希表+vector进行排序操作的更多相关文章

  1. [LeetCode] Top K Frequent Words 前K个高频词

    Given a non-empty list of words, return the k most frequent elements. Your answer should be sorted b ...

  2. 【LeetCode题解】347_前K个高频元素(Top-K-Frequent-Elements)

    目录 描述 解法一:排序算法(不满足时间复杂度要求) Java 实现 Python 实现 复杂度分析 解法二:最小堆 思路 Java 实现 Python 实现 复杂度分析 解法三:桶排序(bucket ...

  3. [LeetCode] Top K Frequent Elements 前K个高频元素

    Given a non-empty array of integers, return the k most frequent elements. For example,Given [1,1,1,2 ...

  4. LeetCode:前K个高频单词【692】

    LeetCode:前K个高频单词[692] 题目描述 给一非空的单词列表,返回前 k 个出现次数最多的单词. 返回的答案应该按单词出现频率由高到低排序.如果不同的单词有相同出现频率,按字母顺序排序. ...

  5. LeetCode:前K个高频元素【347】

    LeetCode:前K个高频元素[347] 题目描述 给定一个非空的整数数组,返回其中出现频率前 k 高的元素. 示例 1: 输入: nums = [1,1,1,2,2,3], k = 2 输出: [ ...

  6. [LeetCode] 347. Top K Frequent Elements 前K个高频元素

    Given a non-empty array of integers, return the k most frequent elements. Example 1: Input: nums = [ ...

  7. Java实现 LeetCode 692 前K个高频单词(map的应用)

    692. 前K个高频单词 给一非空的单词列表,返回前 k 个出现次数最多的单词. 返回的答案应该按单词出现频率由高到低排序.如果不同的单词有相同出现频率,按字母顺序排序. 示例 1: 输入: [&qu ...

  8. 代码随想录算法训练营day12 | leetcode 239. 滑动窗口最大值 347.前 K 个高频元素

    基础知识 ArrayDeque deque = new ArrayDeque(); /* offerFirst(E e) 在数组前面添加元素,并返回是否添加成功 offerLast(E e) 在数组后 ...

  9. Java实现 LeetCode 347 前 K 个高频元素

    347. 前 K 个高频元素 给定一个非空的整数数组,返回其中出现频率前 k 高的元素. 示例 1: 输入: nums = [1,1,1,2,2,3], k = 2 输出: [1,2] 示例 2: 输 ...

  10. 前 K 个高频元素问题

    前 K 个高频元素问题 作者:Grey 原文地址: 前 K 个高频元素问题 题目描述 LeetCode 347. Top K Frequent Elements 思路 第一步,针对数组元素封装一个数据 ...

随机推荐

  1. [转帖]使用SkyWalking监控nginx (以openresty为例)

    https://www.cnblogs.com/hahaha111122222/p/15829737.html 安装使用SkyWalking先看这篇文章,地址:https://www.cnblogs. ...

  2. SPEC2006的学习与总结

    SPEC2006的学习与总结 摘要 最近特别想进行一些性能验证工作. 所以研究了spec2006 然后想整理一下之前的内容. 想着将内容整理一下. 这次主要是抄别人的. 知识来源: https://b ...

  3. [转帖]apt update和apt upgrade命令 - 有什么区别?

    在之前的文章中,我们查看了APT 命令以及您可以使用包管理器来管理包的各种方法.这是一个总体概述,但在本指南中,我们暂停并重点关注 2 个命令用法.这些是apt update和apt upgrade命 ...

  4. [转帖]使用 Shell 运算进行进制转换 16进制转10进制

    使用 Shell 运算进行进制转换 工作时候常常遇到一些问题,拿到的数字是16进制的,但是运算的时候是10进制的,shell可以很方便的处理这类的进制转换问题,一种情况是使用 Shell 运算把一个数 ...

  5. 飞腾2000+上面银河麒麟v10 安装virt-manager创建虚拟机的操作过程

    操作系统安装完之后自带了repos 就可以执行大部分操作, 不需要修改包源 ###Kylin Linux Advanced Server 10 - os repo### [ks10-adv-os] n ...

  6. vue中设置props参数类型

    props参数的使用 在使用vue的项目开发的过程中 经常会定义大量的组件使用 这个时候组件中的定义的数据类型就非常重要了 此时我们需要定义组件中需要的数据类型 之前我只知道简单的几个 今天忽然发现原 ...

  7. 基于密码学的身份混淆系统 -- idmix

    简介 Hyperledger Fabric的Idemix是一个基于密码学的身份混淆系统,它提供了一种在区块链网络中实现用户隐私的方法.Idemix的主要特性是它的零知识证明系统,这是一种允许用户证明他 ...

  8. 【转载】基于Tablestore Timeline的IM(即时通讯)消息系统架构 - 架构篇

    本文原作者:木洛,阿里云高级技术专家,内容有优化和修订,感谢原作者.原文链接:https://developer.aliyun.com/article/698301 IM全称是『Instant Mes ...

  9. 基于中文金融知识的 LLaMA 系微调模型的智能问答系统:LLaMA大模型训练微调推理等详细教学

    基于中文金融知识的 LLaMA 系微调模型的智能问答系统:LLaMA大模型训练微调推理等详细教学 基于 LLaMA 系基模型经过中文金融知识指令精调/指令微调(Instruct-tuning) 的微调 ...

  10. 13.2 外部DirectX绘制实现

    在前一节中我们简单介绍了D3D绘制窗体所具备的基本要素,本节将继续探索外部绘制技术的实现细节,并以此实现一些简单的图形绘制功能,首先外部绘制的核心原理是通过动态创建一个新的窗口并设置该窗口属性为透明无 ...