Mysql数据库order by实现原理

原创已于 2022-05-24 16:53:21 修改 · 1.4k 阅读

1 ·

CC 4.0 BY-SA版权

文章标签：

#mysql

于 2022-04-25 16:08:43 首次发布

mysql 专栏收录该内容

10 篇文章

订阅专栏

本文探讨了在MySQL中，如何通过全字段排序（包括过多字段导致内存消耗）和rowid排序（减少内存占用但需回表查询）来提高根据'北京'城市名按名字排序前1000人的效率。作者还介绍了Mysql内存策略和覆盖索引的概念，以及它们对orderby语句的影响。

摘要生成于 C知道，由 DeepSeek-R1 满血版支持，前往体验 >

业务背景

在应用开发过程中，业务场景可能需要根据某个字段进行排序，并返回指定结果集，就需要用到order by，今天我们来聊聊 order by 的执行流程。

假设你要查询城市是“北京”的所有人的名字，并且按照名字进行排序返回前1000个人的姓名和年龄。建表语句如下：

mysql> create table `user` (
	`id` int(11),
	`name` varchar(16) NOT NULL,
	`age` int(11) NOT NULL,
	`city` varchar(16) NOT NULL,
	PRIMARY KEY(`id`),
	KEY `city` (`city`)
)ENGINE=InnoDB;

SQL语句如下：

mysql> select name, age from user where city = "北京" order by name limit 1000;

全字段排序

为了避免全表扫描，我们需要在city字段上创建索引，用explain命令查看这条语句的执行情况：

mysql> explain select name, age from user where city = "北京" order by name limit 1000;

在这里插入图片描述
可以看到 key 为 city，确实走了索引，扫描行数rows为4000，表示city为北京的记录有4000条，Extra字段中的“Using filesort”，表示需要排序，Mysql 会给每个线程分配一段内存用于排序，这段内存称为sort_buffer。

执行流程：

初始化sort_buffer；
从city索引找到第一个满足city=“北京”条件的主键Id，也就是途中的ID-x；
到主键ID-x索引找到这条记录，拿到name、city、age三个字段的值放入sort_buffer；
从city索引找下一条记录，取到主键id；
重复步骤3、4 直到city不满足条件为止，也就是到途中的ID-y为止；
对sort_buffer中的数据按照name做快速排序；
返回排序结果的前1000条记录；

说明：
步骤6中，按照name字段排序的动作，可能在内存中完成，也可能需要使用外部排序，取决于排序数据所需要的内存和参数sort_buffer_size。sort_buffer_size就是Mysql为排序分配的内存。如果排序的数据量小于sort_buffer_size，排序就在内存中完成，否则就需要利用磁盘的临时文件进行辅助排序。