sql的groupby分组和聚合函数(max、min等)的使⽤(很好
理解版)
为什么不能够select * from Table group by id,为什么⼀定不能是*,⽽只能是某⼀个列或者某个列的聚合函数,group by 多个字段可以怎么去很好的理解呢?
正⽂开始
先来看下表1,表名为test:
表⼀ test
id name number
1aa2
2aa3
3bb4
4bb5
5cc6
6dd7
7ee7
8bb5
9cc6
执⾏如下sql语句:
select name from test
group by name
1
2
你应该很容易知道运⾏的结果,没错,就是下表2:
groupby是什么函数
表2
name
aa
bb
cc
dd
ee
可是为了能够更好的理解“group by”多个列“和”聚合函数“的应⽤,我建议在思考的过程中,由表1到表2的过程中,增加⼀个虚构的中间表:虚拟表3。下⾯说说如何来思考上⾯sql语句执⾏情况:
1.from test:该句执⾏后,应该结果和表1⼀样,就是原来的表。
2.from test group by name:该句执⾏后,我们想象⽣成了虚拟表3,如下所图所⽰,⽣成过程是这样的:group by name,那么name那⼀列,具有相同name值的⾏,合并成⼀⾏,如对于name值为aa
的,那么<1 aa 2>与<2 aa 3>两⾏合并成1⾏,所有的id值和number值写到⼀个单元格⾥⾯。
3.接下来就要针对虚拟表3执⾏select语句了:
(1)如果执⾏select *的话,那么返回的结果应该是虚拟表3,可是id和number中有的单元格⾥⾯的内容是多个值的,⽽关系数据库就是基于关系的,单元格中是不允许有多个值的,所以你看,执⾏select * 语句就报错了。
(2)我们再看name列,每个单元格只有⼀个数据,所以我们select name的话,就没有问题了。为什么name列每个单元格只有⼀个值呢,因为我们就是⽤name列来group by的。
(3)那么对于id和number⾥⾯的单元格有多个数据的情况怎么办呢?答案就是⽤聚合函数,聚合函数就⽤来输⼊多个数据,输出⼀个数据的。如cout(id),sum(number),⽽每个聚合函数的输⼊就是每⼀个多数据的单元格。
(4)例如我们执⾏select name,sum(number) from test group by name,那么sum就对虚拟表3的number列的每个单元格进⾏sum 操作,例如对name为aa的那⼀⾏的number列执⾏sum操作,即2+3,返回5,最后执⾏结果如下:
name(⽆列名)
aa5
bb14
cc12
dd7
ee7
(5)group by 多个字段该怎么理解呢:如group by name,number,我们可以把name和number 看成⼀个整体字段,以他们整体来进⾏分组的。如下图
(6)接下来就可以配合select和聚合函数进⾏操作了。如执⾏select name,sum(id) from test group by name,number,结果如下图:
name(⽆列名)
aa1
name(⽆列名) aa2
bb3
bb12
cc14
dd6
ee7
版权声明:本站内容均来自互联网,仅供演示用,请勿用于商业和其他非法用途。如果侵犯了您的权益请与我们联系QQ:729038198,我们将在24小时内删除。
发表评论