【面试经典150 | 哈希表】字母异位词分组

news2025/6/23 17:35:32

文章目录

  • Tag
  • 题目来源
  • 题目解读
  • 解题思路
    • 方法一:排序+哈希表
    • 方法二:数组作为哈希表的键
    • 方法三:字符串作为哈希表的键
    • 知识回顾
      • accumulate
  • 写在最后

Tag

【自定义哈希】【哈希表】【数组】


题目来源

49. 字母异位词分组


题目解读

将字符串数组中互为字母异位词的字符串组合在一起,并返回最后的结果列表,返回形式见函数的返回值。


解题思路

方法一:排序+哈希表

如果两个字符串互为字母异位词,那么它们按照相同的排序方式(都按照升序或者降序)进行排序之后,得到的字符串是一样的。根据这一点,我们将字符串进行升序排序后的字符串作为键,原字符串作为值的一部分,存放在 unordered_map 中。具体来说,定义的 map,如下所示:

unordered_map<string, vector<string>> str2StrVec;

unordered_map 的键为排序后的字符串,值为互为异位词的字符串组成的数组。

无序哈希表值组成的数组就是我们最终的答案。

实现代码

class Solution {
public:
    vector<vector<string>> groupAnagrams(vector<string>& strs) {
        unordered_map<string, vector<string>> str2StrVec;
        for (string str : strs) {
            string tmpStr = str;
            sort(tmpStr.begin(), tmpStr.end());
            str2StrVec[tmpStr].push_back(str);
        }

        vector<vector<string>> res;
        for (auto [_, strVec] : str2StrVec) {
            res.push_back(strVec);
        }
        return res;
    }
};

复杂度分析

时间复杂度: n k l o g k nklogk nklogk n n n 为字符串数组 strs 的长度, k k kstrs 中字符串的最大长度。

空间复杂度: n k l o g k nklogk nklogk

方法二:数组作为哈希表的键

在方法一中,我们使用的是排序后的字符串作为无序哈希表的键,我们也可以使用 使用数组模拟哈希表 中提到的哈希数组作为键。

具体地,如果两个字符串互为异位词,那么两字符串中出现的字符数量应该是相等的。

字符串中出现的字符都是小写字母,因此我们可以使用长度为 26 的数组 cnts 来表示每个字符出现的次数。

我们把字符对应到下标上,比如字符 'a' 对应数组中的下标为 0,字符 'b' 对应数组中的下标为 1,…,字符 'z' 对应数组中的下标为 25。下标对应的值为该字符出现的次数,比如 cnts[1] = 2 表示字符串中字符 b 出现 2 次。

问题

不能使用 vector<> 数组作为 unorderd_map 的键。也不能使用 pair<> 作为

使用 array<> 会怎么样呢?官方解法 方法二 中的 C++ 代码就是利用的自定义对 array<int, 26> 类型的哈希函数。

经过实测之后,利用官方题解中的自定义哈希函数以及 vector<> 之后,代码依然是可以通过的,稍后我会把代码贴出来。

其实 vector<>array<> 不能直接作为 unordered_map 的键的原因是哈希表重复问题,因此需要我们自定义哈希映射,也就是哈希函数。官方题解中借助的是一个 std::hash<int> 类型的哈希函数对象,用于将 int 类型的值哈希成 size_t,然后借助 accumulate<> 来将 array<int, 26> 累加起来(异或和),实现自定义哈希函数。

官方的自定义哈希+array<int, 26>代码

class Solution {
public:
    vector<vector<string>> groupAnagrams(vector<string>& strs) {
        // 自定义对 array<int, 26> 类型的哈希函数
        auto arrayHash = [fn = hash<int>{}] (const array<int, 26>& arr) -> size_t {
            return accumulate(arr.begin(), arr.end(), 0u, [&](size_t acc, int num) {
                return (acc << 1) ^ fn(num);
            });
        };

        unordered_map<array<int, 26>, vector<string>, decltype(arrayHash)> mp(0, arrayHash);
        for (string& str: strs) {
            array<int, 26> counts{};
            int length = str.length();
            for (int i = 0; i < length; ++i) {
                counts[str[i] - 'a'] ++;
            }
            mp[counts].emplace_back(str);
        }
        vector<vector<string>> ans;
        for (auto it = mp.begin(); it != mp.end(); ++it) {
            ans.emplace_back(it->second);
        }
        return ans;
    }
};

我的自定义哈希+vector<int>代码

class Solution {
public:
    vector<vector<string>> groupAnagrams(vector<string>& strs) {
        // 自定义对 array<int, 26> 类型的哈希函数
        auto arrayHash = [fn = hash<int>{}] (const vector<int>& arr) -> size_t {
            return accumulate(arr.begin(), arr.end(), 0u, [&](size_t acc, int num) {
                return (acc << 1) ^ fn(num);
            });
        };

        unordered_map<vector<int>, vector<string>, decltype(arrayHash)> mp(0, arrayHash);
        for (string& str: strs) {
            vector<int> counts(26, 0);
            int length = str.length();
            for (int i = 0; i < length; ++i) {
                counts[str[i] - 'a'] ++;
            }
            mp[counts].emplace_back(str);
        }
        vector<vector<string>> ans;
        for (auto it = mp.begin(); it != mp.end(); ++it) {
            ans.emplace_back(it->second);
        }
        return ans;
    }
};

复杂度分析

时间复杂度: n k nk nk n n n 为字符串数组 strs 的长度, k k kstrs 中字符串的最大长度

空间复杂度: n k nk nk

方法三:字符串作为哈希表的键

先来看实现代码:

class Solution {
public:
    vector<vector<string>> groupAnagrams(vector<string>& strs) {
        vector<vector<string>> res ;
        map<string, vector<string>> str2StrVec ;

        // 统计string的各字母频次,以频次为key直接加入队列
        for (auto str : strs) {
            string sts = string(26, '0') ;
            for (auto c : str)  ++ sts[c-'a'] ;
            str2StrVec[sts].emplace_back(str) ;
        }
        for (auto [_, strVec] : str2StrVec)  res.emplace_back(strVec) ;

        return res;
    }
};

我们把具有相同字符串 sts 的字符串 str 加入到 str2StrVec[sts] 中。需要注意的是这里的 sts 的更新方式:

  • 初始化 sts26'0' 拼接而成;
  • 我们在 str 中每遇到一个字符 c,我们就将该字符对应的下标 c - 'a'sts 中对应的值加一,对应的是 sts 中的字符,对字符加一实际是对该字符对应的 ASCII \texttt{ASCII} ASCII 加一。

这时候需要注意 “碰撞” 的问题,因为 char 字符类型的上限自多能统计 256 个字符,如果超出了这个数量,那么出现 “哈希冲突”,即 不同的字符对应到了相同的字符上,也就是 “碰撞”。但是本题的当个字符串的数量不超过 100,所以不会出现碰撞。

复杂度分析

时间复杂度: n k nk nk n n n 为字符串数组 strs 的长度, k k kstrs 中字符串的最大长度

空间复杂度: n k nk nk

知识回顾

accumulate

今天我们来看一个 C++ 中的库函数 accumulate(),通常我们使用该函数来计算数组内所有元素的和。

求和操作

我们要计算数组 numbers 中所有元素的和,代码如下:

#include <iostream>
#include <vector>
#include <numeric>

int main() {

    std::vector<int> numbers = {1, 2, 3, 4, 5};
    int sum = std::accumulate(numbers.begin(), numbers.end(), 0);
    std::cout << "Sum of elements: " << sum << std::endl;

    return 0;
}

对应的类模板为:

template <class InputIterator, class T>   
T accumulate (InputIterator first, InputIterator last, T init);	

该类模板表示的含义是将迭代器 [first, last) 内的元素值加到 init 上,我们上述求和代码正是将 numbers 的首迭代器到尾后迭代器中的元素加到 0 上,从而实现了求和。

自定义二元操作

除了求和我们还可以自定义 “二元操作”,实现 accumulate 的其他 “累加” 操作。其对应的类模板为:

template <class InputIterator, class T, class BinaryOperation>  
T accumulate (InputIterator first, InputIterator last, T init, BinaryOperation binary_op);

在本题的方法二中使用的就是 accumulate 的二元操作来计算 array<int, 26> 的哈希值的。

我们通过一个例子来理解 accumulate 的自定义二元操作:计算数组 nums = [12, 24, 36, 48] 中所有元素的最大公约数。先贴上利用 accumulate 自定义二元操作的代码:

#include <iostream>
#include <vector>
#include <numeric>

// 自定义的二元操作函数,计算两个整数的最大公约数
int gcd(int a, int b) {
    while (b != 0) {
        int temp = b;
        b = a % b;
        a = temp;
    }
    return a;
}

int main() {

    std::vector<int> numbers = {24, 36, 48, 60};
    int result = std::accumulate(numbers.begin(), numbers.end(), 0, gcd);
    std::cout << "GCD of elements: " << result << std::endl;

    return 0;
}

在这个示例中,我们定义了一个名为 gcd 的自定义二元操作函数,它计算两个整数的最大公约数。然后,我们使用 std::accumulate 来计算数组 numbers 中所有元素的最大公约数。gcd 函数被传递给 std::accumulate,以执行自定义的累积操作。

这个例子中自定义二元操作的底层逻辑如下代码所示,__init 初始为 0。这段代码的含义是将数组 numbers 中的所有元素都与初始的值 0 进行求最大公约数,并返回。

for (; __first != __last; ++__first) {
	__init = gcd(__init, *__first);
	return __init;
}

学会了自定义二元操作之后,我们也可以通过它来实现求和操作,对应的代码为:

#include <iostream>
#include <vector>
#include <numeric>

int main() {

    std::vector<int> numbers = {2, 4, 6, 60};
    int sumVal = std::accumulate(numbers.begin(), numbers.end(), 0, [](int a, int b) {
        return a + b;
    });
    std::cout << "SUM of numbers: " << sumVal << std::endl;

    return 0;
}

写在最后

如果文章内容有任何错误或者您对文章有任何疑问,欢迎私信博主或者在评论区指出 💬💬💬。

如果大家有更优的时间、空间复杂度方法,欢迎评论区交流。

最后,感谢您的阅读,如果感到有所收获的话可以给博主点一个 👍 哦。

本文来自互联网用户投稿,该文观点仅代表作者本人,不代表本站立场。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。如若转载,请注明出处:http://www.coloradmin.cn/o/1086290.html

如若内容造成侵权/违法违规/事实不符,请联系多彩编程网进行投诉反馈,一经查实,立即删除!

相关文章

面试全攻略:ElasticSearch分页与MySQL分页的底层逻辑与优化技巧

大家好&#xff0c;我是小米&#xff01;今天&#xff0c;我要和大家一起深入探讨一个在技术面试中经常被问到的问题&#xff1a;ElasticSearch中的分页与MySQL中的分页有什么区别&#xff1f;分页是数据库查询中非常常见的操作&#xff0c;但当我们在不同的数据库中执行分页操…

画面清晰如真:OLED透明拼接屏在金华市的画质表现

金华市位于中国浙江省中西部&#xff0c;是中国重要的历史文化名城之一。 金华市拥有悠久的历史和丰富的文化遗产&#xff0c;如古城墙、古建筑和古镇等。 这为OLED透明拼接屏技术的应用提供了丰富的创作素材和展示主题。 金华市的著名景点 义乌国际商贸城&#xff1a;义乌国…

如何开发一款跑酷游戏?

跑酷游戏&#xff08;Parkour Game&#xff09;是一种流行的视频游戏类型&#xff0c;玩家需要在游戏中控制角色进行极限动作、跳跃、爬墙和各种动作&#xff0c;以完成各种挑战和任务。如果你有兴趣开发一款跑酷游戏&#xff0c;以下是一些关键步骤和考虑事项&#xff1a; 游…

职场新人:大公司还是小公司,何去何从?

导言&#xff1a; 对于职场新人来说&#xff0c;选择进入大公司还是小公司是一个重要的决策。大公司通常具有知名度、资源丰富和完善的职业发展路径&#xff0c;而小公司则更加灵活、创新和有机会获得更多的责任。本文将探讨大公司和小公司的优势&#xff0c;并给出一些建议&am…

MySQL下载和安装详细步骤

下载步骤详解 本教程以 MySQL 5.7.29 为例介绍其在 Windows 10 操作系统下的安装和配置过程。 步骤 1)&#xff1a;打开 MySQL 官方网站&#xff08;http://www.mysql.com&#xff09; 步骤 2)&#xff1a;滑到网页底部&#xff0c;点击 DOWNLOADS 列表下的 MySQL Community…

基于SpringBoot的教学辅助平台

目录 前言 一、技术栈 二、系统功能介绍 学生信息管理 教师信息管理 课程信息管理 科目分类管理 班级分类管理 课程作业管理 交流论坛管理 三、核心代码 1、登录模块 2、文件上传模块 3、代码封装 前言 随着信息技术在管理上越来越深入而广泛的应用&#xff0c;管理…

一步步教你如何搭建家政小程序+家政管理系统

在当今数字化时代&#xff0c;家政服务行业也需要紧跟潮流&#xff0c;借助互联网技术提升服务品质和效率。而小程序作为一种轻量级应用&#xff0c;能够帮助家政服务公司在推广、预约、评价等方面实现便捷操作&#xff0c;吸引更多客户。本文将介绍如何轻松搭建家政服务行业的…

那些年你不一定会的磁盘、目录、文件操作(c语言版)

一、前言 今天和大家分享的是使用win32api操作磁盘&#xff0c;目录&#xff0c;文件&#xff0c;这里分为三大块&#xff0c;希望能帮到大家。在讲之前还是先给大家看看效果图&#xff0c;如下图&#xff1a; 二、磁盘 获取盘符下的所有文件夹.rar: https://url18.ctfile.co…

H3C交换机的40G堆叠线 ,可以插在普通光口做堆叠吗?

环境&#xff1a; S6520X-24ST-SI交换机 H3C LSWM1QSTK2万兆40G堆叠线QSFP 问题描述&#xff1a; H3C交换机的40G堆叠线 &#xff0c;可以插在普通光口做堆叠吗&#xff1f; 解答&#xff1a; 1.H3C交换机的40G堆叠线通常是用于连接堆叠模块或堆叠端口的。这些堆叠线通常使…

小谈设计模式(25)—职责链模式

小谈设计模式&#xff08;25&#xff09;—职责链模式 专栏介绍专栏地址专栏介绍 职责链模式分析角色分析抽象处理者&#xff08;Handler&#xff09;具体处理者&#xff08;ConcreteHandler&#xff09;客户端&#xff08;Client&#xff09; 优缺点分析优点123 缺点12 应用场…

Flink on k8s容器日志生成原理及与Yarn部署时的日志生成模式对比

Flink on k8s部署日志详解及与Yarn部署时的日志生成模式对比 最近需要将flink由原先部署到Yarn集群切换到kubernetes集群&#xff0c;在切换之后需要熟悉flink on k8s的运行模式。在使用过程中针对日志模块发现&#xff0c;在k8s的容器中&#xff0c;flink的系统日志只有jobma…

【yolov5】改进系列——特征图可视化

文章目录 前言一、特征图可视化二、可视化指定层三、合并通道可视化总结 前言 对于特征图可视化感兴趣可以参考我的另一篇记录&#xff1a;六行代码实现&#xff1a;特征图提取与特征图可视化&#xff0c;可以实现分类网络的特征图可视化 最近忙论文&#xff0c;想在yolov5上…

使用VSCode进行linux内核代码开发(一)

0. 前言 Linux 内核代码量非常的庞大,其中又包含了各种平台的宏定义开关、配置,外加各种结构体指针的注册,这使得阅读内核代码变成一件令人头疼的事。针对这个问题常见有如下几种方案: source insight 创建项目工程。但是如上所说,对于阅读 linux 代码来说非常困难。而且…

Linux中怎么启动Zookeeper

首先进入Zookeeper安装目录下的bin目录 比如&#xff1a; cd /root/zookeeper-3.4.9/bin 然后在此目录下执行命令。 1. 启动Zookeeper Server端 ./zkServer.sh start 2.启动Zookeeper Client端 ./zkCli.sh 启动Zookeeper Client端后如下&#xff1a;

接口自动化测试_L1

目录&#xff1a; 接口自动化测试框架介绍 接口测试场景自动化测试场景接口测试在分层测试中的位置接口自动化测试与 Web/App 自动化测试对比接口自动化测试与 Web/App 自动化测试对比接口测试工具类型为什么推荐 RequestsRequests 优势Requests 环境准备接口请求方法接口请求…

Web自动化测试进阶:网页中难点之等待机制 —— 强制等待,隐式等待

为什么要添加等待 避免页面未渲染完成后操作&#xff0c;导致的报错 经常会遇到报错&#xff1a;selenium.common.exceptions.NoSuchElementException: Message: no such element: Unable to locate element: {"method":"xpath","selector":&q…

[LitCTF 2023]导弹迷踪

这道题相较于其他的分数类型的js题有一点不一样&#xff0c;他不是像常规的有用bp多次抓包修改最后得分来获取flag的。 本题将flag藏到了他的前端文件中本身没有任何难度&#xff0c;只是为了记录一种新的做法 按照我们平常做js的思路就是先随便玩一下然后bp抓包看得分或者抓包…

如何提升设备投资回报率:预测性维护在制造业的应用

在当今竞争激烈的制造业市场中&#xff0c;企业需要不断寻求提高生产效率和降低成本的方法。作为重要资产之一&#xff0c;设备投资回报率成为制造企业关注的焦点。然而&#xff0c;许多企业在设备维护和管理方面面临着一些挑战&#xff0c;这可能导致设备投资回报率的下降。为…

【重拾C语言】八、表单数据组织——结构体(类型、类型别名、直接/间接访问;典例:复数、成绩单)

目录 前言 八、结构体 8.1 结构体类型 8.2 结构体类型名 8.2.1 typedef关键字 8.2.1 结构体类型别名 8.3 结构体变量 8.3.1 使用结构体类型引用 8.3.2 使用结构体类型定义 8.3.3 使用typedef定义的结构体类型别名 8.4 访问结构体变量 8.4.1 直接成员选择表达式 8.…

如何才能找到合适的法语交传翻译服务呢?

法语交传&#xff0c;无需其他语言介入&#xff0c;直接在口译者与听众之间进行即时翻译&#xff0c;这是一种高级口译服务。法语交传在国际会议、商务谈判、法律诉讼等各种场合中发挥着至关重要的作用。那么&#xff0c;如何才能找到合适的法语交传翻译服务呢&#xff1f;法语…