请你谈谈Mysql Join算法原理？

最新推荐文章于 2024-05-07 14:52:49 发布

@Autowire

最新推荐文章于 2024-05-07 14:52:49 发布

阅读量126

点赞数

分类专栏：数据库-MySQL

本文链接：https://blog.csdn.net/zs18753479279/article/details/115022900

版权

数据库-MySQL 专栏收录该内容

26 篇文章 1 订阅

订阅专栏

1Mysql Join算法原理

1Simple Nested-Loop Join（简单的嵌套循环连接）

嵌套循环连接算法就是一个双层for 循环，通过循环外层表的行数据，逐个与内层表的所有行数据进行比较来获取结果。

select * from user tb1 left join level tb2 on tb1.id=tb2.user_id

for(user表的行 ur : user表){
	for(level表的行 lr : level表){
		if(ur.id == lr.user_id){
			// 返回匹配成功的数据
		}
	}
}

Nested-Loop Join 简单粗暴容易理解，就是通过双层循环比较数据来获得结果，但是这种算法显然太过于粗鲁，如果每个表有1万条数据，那么对数据比较的次数=1万 * 1万 =1亿次，很显然这种查询效率会非常慢。当然mysql 肯定不会这么粗暴的去进行表的连接，所以就出现了后面的两种对Nested-Loop Join 优化算法，在执行join 查询时mysql 会根据情况选择后面的两种优join优化算法的一种进行join查询。

2Index Nested-Loop Join（索引嵌套循环连接）

Index Nested-Loop Join其优化的思路主要是为了减少内层表数据的匹配次数，简单来说Index Nested-Loop Join 就是通过外层表匹配条件直接与内层表索引进行匹配，避免和内层表的每条记录去进行比较，这样极大的减少了对内层表的匹配次数，从原来的匹配次数=外层表行数 * 内层表行数,变成了外层表的行数 * 内层表索引的高度，极大的提升了 join的性能。 注意：使用Index Nested-Loop Join 算法的前提是匹配的字段必须建立了索引。

3Block Nested-Loop Join（缓存块嵌套循环连接）

Block Nested-Loop Join 其优化思路是减少内层表的扫表次数，通过简单的嵌套循环查询的图，我们可以看到，左表的每一条记录都会对右表进行一次扫表，扫表的过程其实也就是从内存读取数据的过程，那么这个过程其实是比较消耗性能的。所以缓存块嵌套循环连接算法意在通过一次性缓存外层表的多条数据，以此来减少内层表的扫表次数，从而达到提升性能的目的。

如果无法使用Index Nested-Loop Join的时候，数据库是默认使用的是Block Nested-Loop Join算法的。

3Join 算法总结

Index Nested-Loop Join 是通过索引的机制减少内层表的循环匹配次数达到优化效果，而Block Nested-Loop Join 是通过一次缓存多条数据批量匹配的方式来减少内层表的扫表次数，通过理解join 的算法原理我们可以得出以下表连接查询的优化思路。

1、永远用小结果集驱动大结果集(其本质就是减少外层循环的数据数量)
2、为匹配的条件增加索引(减少内层表的循环匹配次数)
3、增大join buffer size的大小（一次缓存的数据越多，那么内层包的扫表次数就越少）
4、减少不必要的字段查询（字段越少，join buffer 所缓存的数据就越多）

@Autowire

关注

0
点赞
踩
0

收藏

觉得还不错? 一键收藏
1
评论
请你谈谈Mysql Join算法原理？

1Mysql Join算法原理1Simple Nested-Loop Join（简单的嵌套循环连接）嵌套循环连接算法就是一个双层for 循环，通过循环外层表的行数据，逐个与内层表的所有行数据进行比较来获取结果。select * from user tb1 left join level tb2 on tb1.id=tb2.user_idfor(user表的行 ur : user表){ for(level表的行 lr : level表){ if(ur.id == lr.user_id){
复制链接

扫一扫