文章转载自:http://blog.csdn.net/hao1066821456/article/details/69556644
假设现在有一张表,表名为test,表中的内容如下:
id | name | number |
---|---|---|
1 | aa | 3 |
2 | aa | 4 |
3 | bb | 5 |
4 | bb | 6 |
5 | cc | 7 |
6 | dd | 8 |
7 | dd | 9 |
8 | ee | 10 |
如果执行如下的SQL语句:
select name from test
group by name;
执行结果为:
name |
---|
aa |
bb |
cc |
dd |
ee |
为了能够更好的理解group by与“多个列”、“聚合函数”的应用,可以在思考过程中加入一张虚拟的表,帮助我们理解。针对上面的SQL语句的执行过程,解释如下:
1. from test:该句执行后,应该结果和表test一样,还是原来的表;
2. from test group by name:该句执行后,我们想象生成了虚拟表3,如下所图所示,生成过程是这样的:group by name,那么找name那一列,name值相同的行,合并成一行。例如,对于name值为aa的,那么<1 aa 2>与<2 aa 3>两行合并成1行,所有的id值和number值写到一个单元格里面;
3.接下来就要针对虚拟表3执行Select语句了:
(1)如果执行select *的话,那么返回的结果应该是虚拟表3,可是id和number中有的单元格里面的内容是多个值的,而关系数据库就是基于关系的,单元格中是不允许有多个值的,所以执行select * 语句就报错了。
(2)再看name列,每个单元格只有一个数据,所以我们select name的话,就没有问题了。为什么name列每个单元格只有一个值呢,因为我们就是用name列来group by的。
(3)那么对于id和number里面的单元格有多个数据的情况怎么办呢?答案就是用聚合函数,聚合函数就用来输入多个数据,输出一个数据的。如cout(id),sum(number),而每个聚合函数的输入就是每一个多数据的单元格。
(4)例如我们执行select name,sum(number) from test group by name,那么sum就对虚拟表的number列的每个单元格进行sum操作,例如对name为aa的那一行的number列执行sum操作,即3+4,返回7,最后执行结果如下:
(5)group by 多个字段该怎么理解呢:如group by name,number,我们可以把name和number 看成一个整体字段,以它们整体来进行分组。如下图:
(6)接下来就可以配合select和聚合函数进行操作了。如执行select name,sum(id) from test group by name,number,结果如下图: