如何解决MySQL在千万级数据量下深分页导致的查询缓慢问题?

酷萱大大_7485

酷萱大大_7485

2026-07-07

207人浏览

原创

limit offset, size在千万级表中变慢是因为mysql需扫描offset+size行,逐行排序、回表并丢弃前offset行,导致全索引扫描、大量随机i/o和回表开销。

如何解决mysql在千万级数据量下深分页导致的查询缓慢问题?

为什么 LIMIT offset, size 在千万级表里会越来越慢

MySQL 执行 LIMIT 1000000, 20 时,并不会跳到第 1000001 行再读,而是从头扫描 1000020 行,逐行计数、排序、回表,最后丢弃前 1000000 行。这导致三个硬伤:全索引扫描 + 大量回表 + 随机 I/O。尤其当 SELECT * 遇上无覆盖索引时,每丢弃一行,就多一次聚簇索引查找——2000 万数据扫到第 100 万页,等于做了百万次随机磁盘寻道。

延迟关联写法必须满足的 3 个前提条件

延迟关联(INNER JOIN 子查询)不是套个 SQL 就能生效,它依赖底层索引行为:

  • ORDER BY 字段必须有索引,且该索引要能覆盖 WHERE 条件最左前缀(比如 WHERE status = 1 + ORDER BY created_at DESC,索引得建为 (status, created_at))
  • 子查询里只能 SELECT id(或其它索引覆盖字段),不能带 SELECT * 或非索引字段,否则照样触发回表
  • 外层 JOIN 的主表别名(如 t1)和子查询别名(如 t2)必须明确,且 ON t1.id = t2.id 中的 id 是主键或唯一键,否则可能产生笛卡尔积

示例有效写法:

MySQL
MySQL

编写正确的MySQL查询,避免字符集、索引和锁方面的常见陷阱。

下载
SELECT t1.* FROM t_order t1 INNER JOIN ( SELECT id FROM t_order WHERE status = 1 ORDER BY created_at DESC LIMIT 1000000, 20 ) t2 ON t1.id = t2.id;

游标分页(Keyset Pagination)怎么避免“上一页末尾值重复”陷阱

用 WHERE id > last_seen_id 替代 LIMIT offset, size 是最快的方案,但实际落地常因排序字段重复而漏数据或翻页错乱:

  • 如果排序字段是 datetime 类型(如 created_at),大量记录时间相同,仅靠 WHERE created_at > '2025-01-01' 会跳过同时间戳的其他行
  • 正确做法是复合排序:在 ORDER BY created_at DESC, id ASC 的同时,索引建为 (created_at, id),下一页参数传 last_seen_created_at 和 last_seen_id 两个值
  • 首次查询必须加 LIMIT N+1(比如要 20 条,查 21 条),取第 21 条的 (created_at, id) 作为下一页游标,否则无法判断是否还有下一页

EXPLAIN 看不出问题?重点盯这 3 个字段

加了索引却没提速,往往是因为执行计划被误读。真正要盯的是:

  • type:必须是 range 或 ref,如果是 index,说明在全索引扫描,优化没起效
  • rows:数值应接近你想要的 size(比如 LIMIT 20 时 rows 是 20~50),而不是 offset + size(如 1000020)
  • Extra:出现 Using filesort 或 Using temporary 就是排序没走索引;Using index 表示覆盖索引生效,Using where; Using index 更理想

一个容易被忽略的细节:MySQL 8.0+ 对 ORDER BY ... LIMIT 有优化,但仅限于单列主键或唯一索引排序。只要涉及 WHERE 过滤 + 复合排序,就必须靠人工建对索引,优化器不会自动补救。

相关文章

PHP速学视频免费教程(入门到精通)
PHP速学视频免费教程(入门到精通)

PHP怎么学习?PHP怎么入门?PHP在哪学?PHP怎么学才快?不用担心,这里为大家提供了PHP速学教程(入门到精通),有需要的小伙伴保存下载就能学习啦!

下载

相关标签:

mysql

本站声明:本文内容由网友自发贡献,版权归原作者所有,本站不承担相应法律责任。如您发现有涉嫌抄袭侵权的内容,请联系admin@php.cn

相关专题

更多
大数据分析工具有哪四个
大数据分析工具有哪四个

大数据分析的四个工具分别是rapidminer、Hpcc、Hadoop和Pentaho bi。大数据分析用于从各种来源生成的原始数据中提取有价值的数据。这些数据帮助我们获得有意义的见解、隐藏的模式、未知的相关性、市场趋势等等,具体取决于行业。大数据分析的主要动机是提供有价值的见解,以便为未来做出更好的决策。php中文网为大家带来了大数据分析的相关教程、以及相关文章等内容,供大家免费下载使用。

2023.06.21

4436

5

Java 大数据处理基础(Hadoop 方向)
Java 大数据处理基础(Hadoop 方向)

本专题聚焦 Java 在大数据离线处理场景中的核心应用,系统讲解 Hadoop 生态的基本原理、HDFS 文件系统操作、MapReduce 编程模型、作业优化策略以及常见数据处理流程。通过实际示例(如日志分析、批处理任务),帮助学习者掌握使用 Java 构建高效大数据处理程序的完整方法。

2025.12.08

1229

12

大数据专业学习教程
大数据专业学习教程

本专题整合了大数据专业学习相关教程,阅读专题下面的文章了解更多详细内容。

2026.01.05

223

5

python处理大数据合集
python处理大数据合集

本专题整合了python处理大数据相关教程,阅读专题下面的文章了解更多详细内容。

2026.01.05

446

22

mysql修改数据表名
mysql修改数据表名

MySQL修改数据表:1、首先查看数据库中所有的表,代码为:‘SHOW TABLES;’;2、修改表名,代码为:‘ALTER TABLE 旧表名 RENAME [TO] 新表名;’。php中文网还提供MySQL的相关下载、相关课程等内容,供大家免费下载使用。

2023.06.20

2053

6

MySQL创建存储过程
MySQL创建存储过程

存储程序可以分为存储过程和函数,MySQL中创建存储过程和函数使用的语句分别为CREATE PROCEDURE和CREATE FUNCTION。使用CALL语句调用存储过程智能用输出变量返回值。函数可以从语句外调用(通过引用函数名),也能返回标量值。存储过程也可以调用其他存储过程。php中文网还提供MySQL创建存储过程的相关下载、相关课程等内容,供大家免费下载使用。

2023.06.21

1259

5

mongodb和mysql的区别
mongodb和mysql的区别

mongodb和mysql的区别:1、数据模型;2、查询语言;3、扩展性和性能;4、可靠性。本专题为大家提供mongodb和mysql的区别的相关的文章、下载、课程内容,供大家免费下载体验。

2023.07.18

735

5

mysql密码忘了怎么查看
mysql密码忘了怎么查看

MySQL是一个关系型数据库管理系统,由瑞典MySQL AB 公司开发,属于 Oracle 旗下产品。MySQL 是最流行的关系型数据库管理系统之一,在 WEB 应用方面,MySQL是最好的 RDBMS 应用软件之一。那么mysql密码忘了怎么办呢?php中文网给大家带来了相关的教程以及文章,欢迎大家前来阅读学习。

2023.07.19

2732

5

mysql创建数据库
mysql创建数据库

MySQL是一个关系型数据库管理系统,由瑞典MySQL AB 公司开发,属于 Oracle 旗下产品。MySQL 是最流行的关系型数据库管理系统之一,在 WEB 应用方面,MySQL是最好的 RDBMS 应用软件之一。那么mysql怎么创建数据库呢?php中文网给大家带来了相关的教程以及文章,欢迎大家前来阅读学习。

2023.07.25

4528

4

热门下载

更多
网站特效
/
网站源码
/
网站素材
/
前端模板

精品课程

更多
相关推荐
/
热门推荐
/
最新课程
PostgreSQL vs MySQL
PostgreSQL vs MySQL

共1课时 | 178人学习

使用phpenv集成环境安装极致CMS
使用phpenv集成环境安装极致CMS

共2课时 | 282人学习