1.MySQL的书写顺序
SELECT …
FROM …
WHERE …
GROUP BY …
HAVING …
ORDER BY …
2.MySQL的执行顺序
FROM …
JOIN …
ON …
WHERE …
GROUP BY …
AVG SUM…
HAVING …
SELECT …
DISTINCT …
ORDER BY …
LIMIT …
在执行过程中,每个步骤都会为下一个步骤生成一个虚拟表,这个虚拟表作为下一个执行步骤的输入。
第一步:首先对 FROM 子句中的前两个表执行一个笛卡尔乘积,此时生成虚拟表 vt1(选择相对小的表做基础表)。
第二步:应用 ON 筛选器,ON 中的逻辑表达式将应用到 vt1 的每一行,筛选出满足 ON 逻辑表达式的行,生成虚拟表 vt2。
第三步:如果是 outer join 那么这一步就将添加外部行,left outer join 就把左表在第二步中过滤的添加进来,right outer join 就将右表在在第二步中过滤掉的行添加进来,这样就生成了虚拟表 vt3。
第四步:如果 FROM 子句中的表数目多于两个表,那么就将 vt3 和第三个表连接从而计算笛卡尔乘积,生成虚拟表,该过程就是一个重复1-3的步骤,最终得到一个新的虚拟表 vt3。
第五步:应用 WHERE 筛选器,对上一步生产的虚拟表应用 WHERE 筛选器,生成虚拟表 vt4 。
第六步:group by 子句将中的唯一的值组合成为一组,得到虚拟表vt5。如果应用了group by,那么后面的所有步骤都只能得到的vt5的列或者是聚合函数(count、sum、avg等)。原因在于最终的结果集中只为每个组包含一行。这一点请牢记。
第七步:应用cube或者rollup选项,为vt5生成超组,生成 vt6 。
第八步:应用having筛选器,生成vt7。having筛选器是第一个也是为唯一一个应用到已分组数据的筛选器。
第九步:处理select子句。将vt7中的在select中出现的列筛选出来。生成 vt8 。
第十步:应用distinct子句,vt8中移除相同的行,生成vt9。事实上如果应用了group by子句那么distinct是多余的,原因同样在于,分组的时候是将列中唯一的值分成一组,同时只为每一组返回一行记录,那么所以的记录都将是不相同的。
第十一步:应用order by子句。按照order_by_condition排序vt9,此时返回的一个游标,而不是虚拟表。sql是基于集合的理论的,集合不会预先对他的行排序,它只是成员的逻辑集合,成员的顺序是无关紧要的。对表进行排序的查询可以返回一个对象,这个对象包含特定的物理顺序的逻辑组织。这个对象就叫游标。正因为返回值是游标,那么使用order by 子句查询不能应用于表表达式。排序是很需要成本的,除非你必须要排序,否则最好不要指定order by,最后,在这一步中是第一个也是唯一一个可以使用select列表中别名的步骤。
第十二步:应用top选项。此时才返回结果给请求者即用户。