散列表(上):Word 文档中单词拼写检查功能是如何实现的?

本文是学习算法的笔记,《数据结构与算法之美》,极客时间的课程

在平时我们使用Word的时候,输入一个错误的单词,它就会用标红的方式提示“拼写错误”。Word的这个单词拼写检查功能,虽然很小却非常实用,它是怎么实现的呢?

其实一点儿都不难,只要你学习今天的内容,散列表(Hash Table)。你就能像微软Office的工程师一样,轻松实现这个功能。

散列思想

散列表的英文叫“Hash Table”,我们平常也叫它“哈希表”或者“Hash 表”。它是用数组支持按照下标随机访问数据的特性,所以散列表其实就是数组的一种扩展,由数组演化而来。可以说,如果没有数组,就没有散列表。

我用一个例子来解释下,假设我们有89名选手参加校运动会。为了方便记录成绩,每个选手胸前都会贴上自己的参赛号码。这89名选手的编号依次是1到89。现在我们希望编程实现这样一个功能,通过编号快速找到对应的选手信息。你会怎么做呢?

可以把这89名选手的信息放在数组里。编号为1的选手,放到数组中下标为1的位置;编号为2的选手,放在数组中下标为2的位置,以此类推,编号为k的选手放到数组中下标为k的位置。

当需要查询参赛编号为x 的选手时,我们只需要把下标为x 的数组元素取出来就可以了,时间复杂度是O(1)。这样的效率是不是很高?

实际上,这个例子已经用到了散列的思想。参赛编号是自然数,并且与数组下标形成一一映射,所以利用数组支持根据下标随机访问的时候,时间复杂度是O(1)这一特性,就可以实现快速对应编号的选手的成绩。

你可能要说了,这个例子中蕴含的散列思想不够明显,那我来改造下这个例子。

假设校长说,参赛编号不能设置得这么简单,要加上年级、班级这些详细的信息,所以我们把编号的规则稍微修改了一下,用6位数字来表示。比如051167,其中前两位05表示年级,中间两位11表示班级,最后两还是原来的编号1到89,这个时候我们该如何存储选手的信息,才能够支持通过编号来快速查找选手的信息呢?

思路还是跟前面的类似,尽管我们不能

评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值