面试官:会SQL调优,那你知道索引合并吗?|金三银四系列

本文详细介绍了 merge index 优化的原理和三种对应的算法。

点击上方“后端开发技术”,选择“设为星标” ,优质资源及时送达

什么是索引合优化

在使用 explain 命令分析 SQL 执行情况的时候,type列会描述了表如何被连接,这个列的内容直接反映了SQL执行的效率。当里面的内容展示为 index_merge时表示使用了索引合并优化,在这种情况下输出行中的key列包含具体使用的索引。

6c059d655ad625716cfe3a95719ea579.png

MySQL的索引合并优化是一种查询优化技术,它利用多个索引来加速查询的执行。当一个查询中包含多个条件,并且这些条件分别适用于不同的索引时,MySQL可以将这些索引合并起来使用,减少了回表的次数,以加速查询的执行。

简单来说过程是这样:

  1. 查询条件同时包含index1和index2。

  2. 在根据index1和index2查询到主键后并没有直接分别去聚簇索引中查询,而是先对他们查到的主键做处理,合并到一起。

  3. 根据处理后的主键去聚簇索引执行查询,只需一次回表就可以拿到结果。

34bfd433134720587895a454a99c47ef.png

下面我们探究一下索引合并的几种情况。

准备

我们使用如下数据做测试,并且建立了三个索引。

CREATE TABLE `test_table` (
  `id` bigint(20) NOT NULL AUTO_INCREMENT,
  `user_id` bigint(20) NOT NULL,
  `name` varchar(255) DEFAULT '',
  `merchant_id` bigint(20) NOT NULL,
  `area` int(11) DEFAULT NULL,
  PRIMARY KEY (`id`),
  UNIQUE KEY `uq_user_id` (`user_id`) USING BTREE,
  KEY `idx_merchant_id` (`merchant_id`) USING BTREE,
  KEY `idx_area` (`area`) USING BTREE
) ENGINE=InnoDB AUTO_INCREMENT=410 DEFAULT CHARSET=utf8mb4

在表中,我初始化了 100 多条数据用于测试。

基本用法

Index Merge通过多次 range扫描检索行并将它们的结果合并为一个。仅限合并来自单个表的索引扫描,而不是跨多个表的扫描。合并可以产生其底层扫描的并集、交集或交集并集,所以产生了三种算法。

可以使用索引合并的示例查询:

SELECT * FROM test_table WHERE merchant_id = 3 OR area = 3;

SELECT * FROM test_table WHERE (merchant_id = 3 OR area = 3) AND name = 'daniel';

SELECT * FROM t1, t2
  WHERE (t1.key1 IN (1,2) OR t1.key2 LIKE 'value%')
  AND t2.key1 = t1.some_col;

SELECT * FROM t1, t2
  WHERE t1.key1 = 1
  AND (t2.key1 = t1.some_col OR t2.key2 = t1.some_col2);

注意点:

索引合并优化算法具有以下注意事项:

  • 如果您的查询有一个复杂的WHERE 子句,带有深度 AND/OR 嵌套,而 MySQL 没有选择最佳执行计划,请尝试使用以下恒等变换。

    (x AND y) OR z => (x OR z) AND (y OR z)
    (x OR y) AND z => (x AND z) OR (y AND z)
  • Index Merge 不适用于全文索引。

三种算法

Index Merge 访问方法有几种算法,显示在输出Extra字段 中EXPLAIN

  • 交集算法Using intersect(...)

  • 并集算法 Using union(...)

  • 排序并集算法Using sort_union(...)

下面我们详细介绍这些算法,优化器根据各种可用选项的成本估算,在不同的索引合并算法之间进行选择。

Index Merge 的使用受制于 系统变量的index_mergeindex_merge_intersectionindex_merge_unionindex_merge_sort_unionflags的值optimizer_switch 。默认情况下,所有这些标志都是on. 要仅启用某些算法,请设置index_mergeoff,并仅启用应允许的其他算法。

1.交集算法

当查询条件是多个查询的时候,并且条件用 and 关联,这种情况会使用交集(intersect)算法,满足以下条件之一都可以。

  • 这种形式的 -part表达式*N*,其中索引具有精确的 *N*部分(即,所有索引部分都被覆盖):

key_part1 = const1 AND key_part2 = const2 ... AND key_partN = constN
985366bd3b143fcddc4033553846f72d.png
  • InnoDB 引擎下使用主键范围条件查询。如果其中一个 merge 条件是对表主键的范围查询,则它不用于行检索,而是用于过滤掉使用其他条件检索的行。

explain select * from test_table where id<  100   and area=3;
b5c4abfddac9924890669d33ddf26106.png

索引合并交集算法对所有使用的索引执行同时扫描,并生成它从合并索引扫描中接收到的主键的交集。如果查询中使用的所有列都被使用的索引覆盖,则不会检索完整的表行(具体使用的算法输出在 Extra 字段中)。

2.并集算法

并集(union)算法适用于将表的WHERE 子句转换为不同索引列组合的多个范围条件,并且使用OR关联,且每个条件为以下之一:

  • 不同普通索引列使用or关联

key_part1 = const1 OR key_part2 = const2 ... OR key_partN = constN
  • InnoDB引擎下主键使用范围查询

例子:

explain select * from test_table where merchant_id = 3 or area=3;
9912c0ed3a0ffe4c295e208e307dc7cc.png

排序并集算法

排序并集(sort_union)算法适用于由 or 关键词组合的多个范围查询。

例子:

explain select * from test_table where merchant_id < 3 or area<3;

sort-union 算法和 union 算法之间的区别在于,sort-union 算法必须首先获取所有行的行 ID ,然后在回表之前它们进行排序。

ecf9a596c330ac5db5d97e9ccb4f7ade.png

最后,欢迎大家提问和交流。

加入讨论群是升职加薪第一步!

回复:加群

03e1f5f5e133657fe5268a601b73fe7f.jpeg

点赞是一种美德,如对您有帮助,欢迎评论和分享,感谢阅读!

CAP、BASE理论真的很重要!|分布式事务系列(一)

2023-03-17

ff8376147dbe08c4ff3452f1acbf0d0a.jpeg

面试没有分库分表经验,那这篇不能错过!|金三银四系列

2023-03-12

44f8ba6c8f3bb57fa268750ab94e099b.jpeg

问到ThreadLocal,看这一篇就够了|金三银四系列

2023-03-08

e7c1c979635ef6f73468cf9ea0d12556.jpeg
  • 0
    点赞
  • 0
    收藏
    觉得还不错? 一键收藏
  • 打赏
    打赏
  • 0
    评论

“相关推荐”对你有帮助么?

  • 非常没帮助
  • 没帮助
  • 一般
  • 有帮助
  • 非常有帮助
提交
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包

打赏作者

西海幼鸟

你的鼓励将是我创作的最大动力

¥1 ¥2 ¥4 ¥6 ¥10 ¥20
扫码支付:¥1
获取中
扫码支付

您的余额不足,请更换扫码支付或充值

打赏作者

实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值