从头学SQL（四）：SQL的执行顺序

最新推荐文章于 2024-06-27 16:15:36 发布

旭小爷丶

最新推荐文章于 2024-06-27 16:15:36 发布

阅读量352

点赞数

分类专栏： SQL 数据库文章标签： sql 数据库

本文链接：https://blog.csdn.net/qq_38337430/article/details/106288191

版权

数据库同时被 2 个专栏收录

8 篇文章 0 订阅

订阅专栏

SQL

7 篇文章 1 订阅

订阅专栏

文章目录

引用
SQL的执行顺序
实例
执行计划
- 1、什么是执行计划
- 2、执行计划的内容

引用

关于sql和MySQL的语句执行顺序(必看！！！)
sql语句执行顺序
 MySql执行顺序及执行计划
建议看原文

SQL的执行顺序

1.from
2.join
3.on
4.where
5.group by
6.avg,sum…（SQL函数）
7.having
8.select
9.distinct
10.order by

从这个顺序中我们不难发现，所有的查询语句都是从from开始执行的，在执行过程中，每个步骤都会为下一个步骤生成一个虚拟表，这个虚拟表将作为下一个执行步骤的输入。

(1) SELECT (2)DISTINCT<select_list>
(3) FROM <left_table>
(4) <join_type> JOIN <right_table>
(5)         ON <join_condition>
(6) WHERE <where_condition>
(7) GROUP BY <group_by_list>
(8) WITH {CUBE|ROLLUP}
(9) HAVING <having_condition>
(10) ORDER BY <order_by_condition>
(11) LIMIT <limit_number>

第一步：对FROM子句中的左表<left_table> 和 右表<right_table> 执行笛卡儿积，产生虚拟表VT1;

第二步：接下来便是应用ON筛选器，ON中的逻辑表达式将应用到 vt1 中的各个行，筛选出满足on逻辑表达式（<join_condition>）的行，生成虚拟表 VT2 ；

第三步：如果是OUTER JOIN 那么这一步就将添加外部行，（left outer jion 就把左表在第二步中过滤的添加进来，如果是right outer join 那么就将右表在第二步中过滤掉的行添加进来）这样生成虚拟表 VT3 。如果FROM子句中的表数目多于两个表，那么就将VT3和第三个表连接从而计算笛卡尔乘积，生成虚拟表，该过程就是一个重复1-3的步骤，最终得到一个新的虚拟表VT3。

第四步：应用WHERE筛选器，对上一步生产的虚拟表引用WHERE筛选器，生成虚拟表VT4，

在这有个比较重要的细节不得不说一下，对于包含outer join子句的查询，就有一个让人感到困惑的问题，到底在on筛选器，还是用where筛选器指定逻辑表达式呢？
on和where的最大区别在于，如果在on应用逻辑表达式那么在第三步outer join中还可以把移除的行再次添加回来，而where的移除的最终的。

举个简单的例子：

有一个学生表（班级,姓名）和一个成绩表(姓名,成绩)，我现在需要返回一个x班级的全体同学的成绩，但是这个班级有几个学生缺考，也就是说在成绩表中没有记录。
为了得到我们预期的结果我们就需要在on子句指定学生和成绩表的关系（学生.姓名=成绩.姓名）那么我们是否发现在执行第二步的时候，对于没有参加考试的学生记录就不会出现在vt2中，因为他们被on的逻辑表达式过滤掉了,但是我们用left outer join就可以把左表（学生）中没有参加考试的学生找回来，因为我们想返回的是x班级的所有学生，如果在on中应用学生.班级='x’的话，left outer join会把x班级的所有学生记录找回，所以只能在where筛选器中应用学生.班级=‘x’ 因为它的过滤是最终的。

第五步：根据GROUP BY子句中的列（<group_by_list>），对VT4中的记录进行分组操作，产生VT5。如果应用了group by，那么后面的所有步骤都只能得到的VT5的列或者是聚合函数（count、sum、avg等）。原因在于最终的结果集中每个组只包含一行。 这一点请牢记。

第六步：应用cube或者rollup选项，为VT5生成超组，生成VT6.

第七步：应用HAVING筛选器，生成VT7。

HAVING筛选器是第一个也是为唯一一个应用到已分组数据的筛选器。

第八步：处理SELECT子句。将VT7中的在SELECT中出现的列筛选出来。生成VT8.

第九步：应用DISTINCT子句，VT8中移除相同的行，生成VT9。

事实上如果应用了GROUP BY子句那么DISTINCT是多余的。
原因同样在于，分组的时候是将列中唯一的值分成一组，同时只为每一组返回一行记录，那么所以的记录都将是不相同的。

第十步：应用ORDER BY子句。按照order_by_condition排序VT9，此时返回的一个游标，而不是虚拟表。sql是基于集合的理论的，集合不会预先对他的行排序，它只是成员的逻辑集合，成员的顺序是无关紧要的。

对表进行排序的查询可以返回一个对象，这个对象包含特定的物理顺序的逻辑组织。这个对象就叫游标。 正因为返回值是游标，那么使用order by 子句查询不能应用于表达式。排序是很需要成本的，除非你必须要排序，否则最好不要指定order by.

最后，在这一步中是第一个也是唯一一个可以使用select列表中别名的步骤。

第十一步：LIMIT: 取出指定行的记录，产生虚拟表VT10，并返回给查询用户

开始->FROM子句->WHERE子句->GROUP BY子句->HAVING子句->SELECT子句->ORDER BY子句->LIMIT子句->最终结果

实例

select 考生姓名, max(总成绩) as max总成绩   
from tb_Grade     
where 考生姓名 is not null     
group by 考生姓名     
having max(max总成绩) > 600     
order by max总成绩

在上面的示例中 SQL 语句的执行顺序如下:

首先执行 FROM 子句, 从 tb_Grade 表组装数据源的数据
执行 WHERE 子句, 筛选 tb_Grade 表中所有数据不为 NULL 的数据
执行 GROUP BY 子句, 把 tb_Grade 表按 "学生姓名"列进行分组(注：这一步开始才可以使用select中的别名，他返回的是一个游标，而不是一个表，所以在where中不可以使用select中的别名，而having却可以使用)
计算 max() 聚集函数, 按 “总成绩” 求出总成绩中最大的一些数值
执行 HAVING 子句, 筛选课程的总成绩大于 600 分的
执行SELECT子句，选择考生姓名和max总成绩两列作为最终结果集
执行 ORDER BY 子句, 把最后的结果按 “max总成绩” 进行排序.