SQL 语句的解析过程

最新推荐文章于 2024-07-18 10:25:45 发布

尚硅谷铁杆粉丝

最新推荐文章于 2024-07-18 10:25:45 发布

阅读量552

点赞数

分类专栏： Java 文章标签： java Linux 尚硅谷

本文链接：https://blog.csdn.net/sggtgfs/article/details/84956543

版权

Java 专栏收录该内容

525 篇文章 8 订阅

订阅专栏

2、应用ON过滤，(JOIN 条件)

ON过滤条件是sql的三个过滤条件(ON,WHERE,HAVING)中最先执行的，ON过滤条件应用于前一步生成的虚拟表(VT1-J1)，满足ON过滤条件的行会被加入到虚拟表VT1-J2中。在应用了ON 过滤之后，生成的VT1-J2表如下所示：

C.customerid	C.city	O.orderid	O.customerid
FRNDO	Madrid	1	FRNDO
FRNDO	Madrid	2	FRNDO
KRLOS	Madrid	3	KRLOS
KRLOS	Madrid	4	KRLOS
KRLOS	Madrid	5	KRLOS
MRPHS	Zion	6	MRPHS

3、添加外部列

这个步骤只会出现在使用了外连接的情况。对于外连接(LEFT,RIGHT, or FULL)，你可以标记一个或者两个表作为保留表。作为保留表意味着你希望这个表里面的所有列都被返回，即使它里面的数据不满足ON子句的过滤条件。LEFT OUTER JOIN 把左边的表标记为保留表，RIGHTOUTER JOIN把右边的表作为保留表，FULL OUTER JOIN把两个表都标记为保留表.Step 1-J3为根据VT1-J2中的虚拟表，添加了保留表中不满足ON 条件的列，在未保留表中没有对应的列，因此标记为NULL。这个过程生成了虚拟表VT1-J3。

C.customerid	C.city	O.orderid	O.customerid
FISSA	Madrid	NULL	NULL
FRNDO	Madrid	1	FRNDO
FRNDO	Madrid	2	FRNDO
KRLOS	Madrid	3	KRLOS
KRLOS	Madrid	4	KRLOS
KRLOS	Madrid	5	KRLOS
MRPHS	Zion	6	MRPHS

如果FROM子句中有多个表操作运算，sql会按照从左到右的顺序处理，左边生成的临时表结果作为右边表的输入表。

二、 WHERE 子句

WHERE过滤被应用到前一步生成的临时表中，根据WHERE过滤条件生成临时表VT2。

注意：由于数据现在还没有被分组，因此现在你不能使用聚合运算-例如：你不能使用这样的句子 WHERE orderdate = MAX(orderdate)。另外你也不能使用SELECT子句中创建的变量别名，因为现在还没有处理SELECT子句-例如你不能写这样的句子：SELECT YEAR(orderdate) AS orderyear . . . WHERE orderyear > 2008.

应用这个过滤

WHERE C.city = 'Madrid'

这时生成的临时表VT2的内容如下：

C.customerid	C.city	O.orderid	O.customerid
FISSA	Madrid	NULL	NULL
FRNDO	Madrid	1	FRNDO
FRNDO	Madrid	2	FRNDO
KRLOS	Madrid	3	KRLOS
KRLOS	Madrid	4	KRLOS
KRLOS	Madrid	5	KRLOS

在这个例子中，你需要在ON子句中使用ON C.customerid = O.customerid过滤，没有订单的客户在1-J2这一步中被过滤掉，但是在1-J3这一步中作为外部列又被加回来。但是，由于你只想返回来自Madrid的客户，因此你需要在WHERE子句中过滤城市（WHERE C.city = ‘Madrid’)，如果你放在ON过滤中，不属于Madrid的客户在添加外部列中会被添加回来。

关于ON 和 WHERE 的区别需要在这里说明一下，ON 和WHERE 的主要区别在于 ON 实在添加外部列之前进行过滤，WHERE 是在之后。ON过滤掉的列会在1-J3中添加回来。如果你不需要添加外部列，那么这两个过滤是相同的。

三、 GROUP BY子句

这个子句会把前一步中生成的临时表中的数据进行分组，每一行都会分到并且只分到一个组里，生成虚拟表VT3。VT3表中包含了VT2表中所有的数据，和分组标识符。

这是生成的临时表VT3的内容如下：

Groups C.customerid	C.customerid	C.city	O.orderid	O.customerid
FISSA	FISSA	Madrid	NULL	NULL
FRNDO	FRNDO	Madrid	1	FRNDO
FRNDO	FRNDO	Madrid	2	FRNDO
	KRLOS	Madrid	3	KRLOS
KRLOS	KRLOS	Madrid	4	KRLOS
	KRLOS	Madrid	5	KRLOS

sql最终返回的结果中，每一个分组必须只能返回一行(除非被过滤掉)，因此当一个sql语句中使用了GROUP BY时，在GROUP BY后面处理的子句，如SELECT，HAVING子句等，只能使用出现在GROUP BY后面的列，对于没有出现GROUP BY后面的列必须使用聚合函数(如 MAX ,MIN,COUNT,AVG等)，保证每一个GROUP只返回一行。