转自 http://www.cnblogs.com/wiseblog/articles/4475936.htmlhtml
写在前面的话:用了很久group by,今天早上一觉醒来,忽然感受group by好陌生,总有个筋别不过来,为何不可以select * from Table group by id,为何必定不能是*,而是某一个列或者某个列的聚合函数,group by 多个字段能够怎么去很好的理解呢?不过最后仍是转过来了,简单写写吧,大牛们直接略过吧。数据库
=========正文开始===========函数
先来看下表1,表名为test:spa
表1code
执行以下SQL语句:htm
1blog 2ci |
|
你应该很容易知道运行的结果,没错,就是下表2:
表2
但是为了可以更好的理解“group by”多个列“和”聚合函数“的应用,我建议在思考的过程当中,由表1到表2的过程当中,增长一个虚构的中间表:虚拟表3。下面说说如何来思考上面SQL语句执行状况:
1.FROM test:该句执行后,应该结果和表1同样,就是原来的表。
2.FROM test Group BY name:该句执行后,咱们想象生成了虚拟表3,以下所图所示,生成过程是这样的:group by name,那么找name那一列,具备相同name值的行,合并成一行,如对于name值为aa的,那么<1 aa 2>与<2 aa 3>两行合并成1行,全部的id值和number值写到一个单元格里面。
3.接下来就要针对虚拟表3执行Select语句了:
(1)若是执行select *的话,那么返回的结果应该是虚拟表3,但是id和number中有的单元格里面的内容是多个值的,而关系数据库就是基于关系的,单元格中是不容许有多个值的,因此你看,执行select * 语句就报错了。
(2)咱们再看name列,每一个单元格只有一个数据,因此咱们select name的话,就没有问题了。为何name列每一个单元格只有一个值呢,由于咱们就是用name列来group by的。
(3)那么对于id和number里面的单元格有多个数据的状况怎么办呢?答案就是用聚合函数,聚合函数就用来输入多个数据,输出一个数据的。如cout(id),sum(number),而每一个聚合函数的输入就是每个多数据的单元格。
(4)例如咱们执行select name,sum(number) from test group by name,那么sum就对虚拟表3的number列的每一个单元格进行sum操做,例如对name为aa的那一行的number列执行sum操做,即2+3,返回5,最后执行结果以下:
(5)group by 多个字段该怎么理解呢:如group by name,number,咱们能够把name和number 当作一个总体字段,以他们总体来进行分组的。以下图
(6)接下来就能够配合select和聚合函数进行操做了。如执行select name,sum(id) from test group by name,number,结果以下图: