当前位置:首页 > 短网址资讯 > 正文内容

MySQL升级5.6 SQL变慢调优案例

www.ft12.com8年前 (2017-07-21)短网址资讯2580


背景:

某业务DB从5.5升级5.6后,同一sql执行时间由毫秒级飙升到了20秒,sql文本如下

select * from big_table as t
where ( t.plan_TYPE = 1 or t.plan_TYPE=3 )
and t.limit_TYPE in (10)
and t.xx_ID = 25773208367
and t.USER_ID in (133174222100)
plan by t.gmt_create desc , t.ID desc limit 1,10

以下是解决过程:

查看短网址当前执行计划

*************************** 1. row ***************************
           id: 1
  select_type: SIMPLE
        table: t
         type: range
possible_keys: idx_xx_id,idx_gmt_create
          key: idx_gmt_create
      key_len: 17
          ref: NULL
         rows: 6816016
        Extra: Using index condition; Using where
1 row in set (0.00 sec)

表上短网址数据库的索引分布

  PRIMARY KEY (`id`),
  KEY `idx_xx_id` (`xx_id`,`plan_type`,`user_id`),
  ……
  KEY `idx_gmt_create` (`limit_type`,`xx_id`,`gmt_create`)

该sql选择索引idx_gmt_create,因其符合最左前缀策略,故排序没有使用到filesort,其访问路径大致如下:


  • 反向扫描idx_gmt_create叶子结点,搜寻(limit_type,xx_id)=(10,25773208367)的元组;

  • 回表,验证该元组对应的主键记录是否满足约束(plan_type,user_id)=(1 or 3, 133174222100),满足则计数加1否则丢弃,继续扫描下一个元组;

  • 当计数达到10时,停止扫描,将对应的10条记录返回给客户端; 


root@ 03:20:56>select limit_type,count(*) from big_table group by limit_type;
+-------------+----------+
| limit_type | count(*) |
+-------------+----------+
| NULL | 226865 |
| 9 | 463346 |
| 10 | 13353116 |
+-------------+----------+
3 rows in set (3.13 sec)

作为复合索引的引导列,limit_type字段的选择性惊人的低,这是查询变慢的主要原因之一。之所以要强调”之一”,是因为针对本例,只要其他字段足够给力,即便limit_type=10也能很快执行完毕,查看xx_id的分布情况,也是比较畸形,该sql又很不幸的选择了候选行最多的那个。

root@ 04:01:12>select xx_id,count(*) from big_table where limit_type =10 group by xx_id order by xx_id desc;
+-------------+----------+
| xx_id | count(*) |
+-------------+----------+
| 25773208367 | 13352433 |
| 25770261347 | 2 |
| 258809681 | 148 |
| 1 | 2100 |
+-------------+----------+
4 rows in set (5.79 sec)

如果xx_id=1,该sql最多只需要比较2100条记录即可返回,会很快执行完毕,然后返回短网址背后对应的原始长地址;

即便xx= 25773208367,如果能快速找出满足非索引字段约束的主键记录,sql也会很快执行完毕,mysql是在验证了海量的(limit_type,xx_id)=(10,25773208367)元组后,才凑齐10条同时满足(plan_type,user_id)约束的主键记录,据此我们可以反推出最早满足所有约束条件的user_id,其查询逻辑如下:

select user_id,count(*) from big_table t where limit_type =10 and xx_id =25773208367 and ( t.plan_TYPE = 1 or t.plan_TYPE=3 ) group by user_id having count(*)>=10 order by gmt_create desc limit 1,5; 5 rows in set (1 min 12.42 sec)

执行结果:

+------------+----------+
| user_id | count(*) |
+------------+----------+
| 1851362558 | 15 |
| 2118141658 | 11 |
| 2641244918 | 14 |
| 2448823838 | 17 |
| 16375410 | 32 |
+------------+----------+
5 rows in set (1 min 12.42 sec)

随便挑一个替换25773208367,比如1851362558,执行计划没有变,原本需要运行20多秒的sql却在200毫秒内执行完毕。

 

而5.5版本的执行计划为:

*************************** 1. row ***************************
           id: 1
  select_type: SIMPLE
        table: t
         type: range
possible_keys: idx_xx_id
          key: idx_xx_id
      key_len: 18
          ref: NULL
         rows: 116
        Extra: Using where; Using filesort

虽然采用了filesort,但是经索引idx_xx_id过滤后的候选行非常少,故执行时间很短。


 

解决方案

修改sql,添加force index (idx_xx_id),此方案不够灵活;

修改sql,将排序字段从gmt_create改为gmt_modified,因无法采用索引排序5.6会选择idx_xx_id,此方案可能造成返回数据有误;

修改sql,将t.limit_TYPE in (10)改为t.limit_TYPE >9 and t.limit_TYPE <11,优化器会认为sql没有满足索引最左前缀便不再使用idx_gmt_create,这招似乎有点贱,同时说明MySQL优化器还不够智能。

 

结束语

5.6优化器做了大量改进,以本sql为例,让其选择了idx_gmt_create从而省去了filesort,之所以运行变慢了是因为表字段数据分布太不均匀,而本sql又凑巧满足了各种坑,这算是一个意外吧。




扫描二维码推送至手机访问。

版权声明:本文由短链接发布,如需转载请注明出处。

本文链接:https://www.ft12.com/article_313.html

分享给朋友:

相关文章

干货:从0到0.01,如何从知乎神贴找到创业机会

干货:从0到0.01,如何从知乎神贴找到创业机会

从0到1,提的人多。方法论都在讲:创业要判断风口、进入蓝海商场、挖掘用户刚需、找到细分切入点。 然而怎么找到那个最小的切入点,从0到0.01,却鲜有人提。今天咱们来做一个测验,谈论一个完整的从0到0.01的思路:怎么从用户需要挖掘到商品规划...

使用60进制的程序仿了一个新浪微博短链接生成器

使用60进制的程序仿了一个新浪微博短链接生成器

与其说仿新浪短网址其实算是个嚼头,招引人们的眼球,对于常规的进制算法可以去参看数据结构一书 通过取模方式计算出对应的n进制数,t.cn短网址的原理大致如下:Java代码  int nv =&...

人工智能识别性取向:披着技术外衣的面相学?

人工智能识别性取向:披着技术外衣的面相学?

[ FT12短网址 ] 近期,一份来自斯坦福大学的研讨宣称,他们的算法能够经过对照片中人物的表情、动作和神态停止剖析,推断出人物的性取向。但批判家却以为,这只是披上了人工智能外衣的伪科学和面相学。图片来自“123rf.com.cn...

陕西省各新媒体公司资源分析

陕西省各新媒体公司资源分析

一、数据来源本次数据分析主要收集了陕西本地158家公司的312个公众号进行分析,数据来源于清博、新榜等第三方平台及人工手动采集,数据方面难免有所偏差,所以此次数据分析仅代表个人看法和意见,仅供大家参考,欢迎各位兄弟姐妹指点。(PS:政府机关...

FT12短网址:聊一聊前端自动化测试(上)

FT12短网址:聊一聊前端自动化测试(上)

前言前天本来是想看看了解入门下前端单元测试的,当看完三个Demo之后突然想前端写单元测试主要都测什么内容。好奇之!今日早读文章由天猫@LingyuCoder分享。正文从这开始~为何要测试以前不喜欢写测试,主要是觉得编写和维护测试用例非常的浪...

FT12短网址:未来汽车迭代的核心是大数据AI

8月5日音讯,在今日举行的Rebuild大会2017上,蔚来轿车创始人、董事长李斌发表了《轿车行业的迭代思想》的主题讲演,他表示,大数据AI、用户效劳理念会成为推进未来轿车迭代的中心力气。在开始主题讲演前的简略介绍中,李斌透露,除了受主办方...

发表评论

访客

◎欢迎参与讨论,请在这里发表您的看法和观点。