MySQL分页优化

作者:iVictor 时间:2024-01-13 23:18:50 

最近,帮同事重写了一个MySQL SQL语句,该SQL语句涉及两张表,其中一张表是字典表(需返回一个字段),另一张表是业务表(本身就有150个字段,需全部返回),当然,字段的个数是否合理在这里不予评价。平时,返回的数据大概5w左右,系统尚能收到数据。但12月31日那天,数据量大概20w,导致SQL执行时间过长,未能在规定的时间内反馈结果,于是系统直接报错。

一般的思路是用MySQL的分页功能,即直接在原SQL语句后面增加LIMIT子句。但请注意,虽然你看到的反馈结果只是LIMIT后面指定的数量,于是想当然的以为MySQL只是检索了指定数量的数据,然后给予返回。其实,MySQL内部实现的原理是,检索所有符合where条件的记录,然后返回指定数量的记录。从这个角度来看,直接在原SQL语句后面添加LIMIT子句只能说是一种可以实现功能的方案,但未必最优。

具体在本例中,首先我们来看一下150个字段的表的统计信息:

MySQL分页优化

一行大概就占2k,而Innodb默认页的大小为16k,这意味着,一个页中最多可存储8行的数据。随机读的可能性大大增加。而这无疑会对数据库系统的IO造成极大的压力。 

优化前

如果采用上述方案,即直接在原SQL语句后面增加LIMIT子句,下面,我们来看看它的执行情况。

首先,直接添加LIMIT子句后的SQL语句如下(已省略a1表的150个字段和a2中的一个字段):

FROM upay_csys_scquery_txn_log_his a1  LEFT JOIN upay_csys_trans_code a2 on(a1.int_trans_code=a2.trans_code) WHERE STATUS<>'00' AND settle_date=20151230 limit 50000,10000;


其执行时间如下:

MySQL分页优化

大概执行了32s,绝大部分都花费到Sending data上了。Sending data指的是服务器检索数据,读取数据,并将数据返回给客户端的时间。

关于上述执行结果,有以下几点需要说明:

1. 这是SQL语句多次执行后的结果,这样就可以排除结果缓存的影响,事实上,每次查询的时长都是32s左右。

2. 为什么选用的是limit 50000,10000,而不是0,10000,这个主要是考虑到对于LIMIT子句来说,越到后面,分页的成本越高。基于此,选择了中间值来作为分页的结果。

该语句的执行计划如下:

MySQL分页优化

优化后:

优化的思路:

只对该表的主键进行分页,然后用返回的主键作为子查询的结果,来检索该表其它字段的值。

改写后的SQL语句如下:

FROM upay_csys_scquery_txn_log_his a1  LEFT JOIN upay_csys_trans_code a2 on(a1.int_trans_code=a2.trans_code) where seq_id in (select seq_id from (select seq_id FROM upay_csys_scquery_txn_log_his a1  WHERE STATUS<>'00' AND settle_date=20151230 order by 1 limit 50000,10000) as t);


其执行时间如下:

MySQL分页优化

大概3s多,比第一种方案快了差不多10倍,效果显著。

下面来看看其执行计划(explain extended)

MySQL分页优化

 总结:

1. 改写后的语句原本如下:

FROM upay_csys_scquery_txn_log_his a1  LEFT JOIN upay_csys_trans_code a2 on(a1.int_trans_code=a2.trans_code) where seq_id in (select seq_id FROM upay_csys_scquery_txn_log_his a1  WHERE STATUS<>'00' AND settle_date=20151230 order by 1 limit 50000,10000);


但MySQL报以下错误:

ERROR 1235 (42000): This version of MySQL doesn't yet support 'LIMIT & IN/ALL/ANY/SOME subquery'


需再增加一个嵌套子查询,

比如这样的语句是不能正确执行的。

select * from table where id in (select id from table limit 12);

但是,只要你再加一层就行。如:

select * from table where id in (select t.id from (select * from table limit 12)as t)

这样就可以绕开limit子查询的问题。
问题解决。

2. 如果想查看MySQL查询优化器等价改写后的SQL语句,可首先通过explain extended得到具体的执行计划,然后通过show warnings查看。

具体在本例中,等价改写后的SQL语句如下:

MySQL分页优化

与设想中的执行顺序一致~

3. 如何查看MySQL语句各步骤的执行时间。

标签:MySQL,分页,优化
0
投稿

猜你喜欢

  • vue多页面项目实现版本快照功能示例详解

    2024-04-28 09:23:25
  • 常用的Git便捷操作合集

    2022-02-19 08:16:47
  • Go流程控制代码详解

    2023-09-01 10:21:12
  • SQL Server数据库涉及到的数据仓库概念

    2009-01-15 12:58:00
  • python安装sklearn模块的方法详解

    2023-08-01 17:23:48
  • Javascript实现数组中的元素上下移动

    2024-04-22 22:36:16
  • 利用python画一颗心的方法示例

    2021-06-04 01:14:33
  • 基于JS实现将JSON数据转换为TypeScript类型声明的工具

    2023-06-12 16:20:44
  • golang 网络框架之gin的使用方法

    2023-07-19 02:35:37
  • Django 实现admin后台显示图片缩略图的例子

    2022-05-30 19:46:02
  • python打包exe开机自动启动的实例(windows)

    2023-11-08 06:34:00
  • CentOS7开启MySQL8主从备份、每日定时全量备份(推荐)

    2024-01-15 20:31:18
  • javascript双击自动滚屏单击停止

    2008-10-13 13:05:00
  • Python实现以时间换空间的缓存替换算法

    2021-03-31 13:45:16
  • JS与jQuery判断文本框还剩多少字符可以输入的方法

    2024-04-25 13:07:20
  • 解决Python下json.loads()中文字符出错的问题

    2022-06-17 21:16:52
  • asp中把数据表映射成ajax可调用的json格式的方法

    2010-01-22 15:27:00
  • Python 列表(list)的常用方法

    2022-05-04 19:05:20
  • MySQL order by与group by查询优化实现详解

    2024-01-24 23:27:48
  • 利用ASP+JMAIL进行邮件群发的新思路

    2008-03-20 13:30:00
  • asp之家 网络编程 m.aspxhome.com