使用命令:select 字段 from table_name group by col_name;
注意点:
- 在有group by的查询语句中,select指定的字段要么就包含在group by语句的后面,作为分组的依据,要么就包含在聚合函数中。
- 常用聚合函数有count计数,sum求和,avg平均数,max最大值,min最小值等
1.group by 一个字段:
举栗1. SELECT name FROM test GROUP BY name;
- 1)FROM test GROUP BY name:该句执行后,我们想象生成了虚拟表3,如下所图所示,生成过程是这样的:group by name,那么找name那一列,具有相同name值的行,合并成一行,如对于name值为aa的,那么<1 aa 2>与<2 aa 3>两行合并成1行,所有的id值和number值写到一个单元格里面。
2)执行Select语句了:
(1)如果执行select *的话,那么返回的结果应该是虚拟表3,可是id和number中有的单元格里面的内容是多个值的,此时返回的id和number会是多个值之中的一个,不一定是我们想要的结果。
(2)我们再看name列,每个单元格只有一个数据,所以我们select name的话,就没有问题了。为什么name列每个单元格只有一个值呢,因为我们就是用name列来group by的。
(3)那么对于id和number里面的单元格有多个数据的情况怎么办呢?答案就是用聚合函数,聚合函数就用来输入多个数据,输出一个数据的。如cout(id),sum(number),而每个聚合函数的输入就是每一个多数据的单元格。
(4)例如我们执行select name,sum(number) from test group by name,那么sum就对虚拟表3的number列的每个单元格进行sum操作,例如对name为aa的那一行的number列执行sum操作,即2+3,返回5,最后执行结果如下:
2.group by 多个字段
举栗2. SELECT name,number FROM test GROUP BY name,number;
group by name,number;我们可以把name和number 看成一个整体字段,以他们整体来进行分组的。如
3.having
where 子句的作用是在对查询结果进行分组前,将不符合where条件的行去掉,即在分组之前使用where条件过滤出特定的行,where条件中不能包含聚组函数。
having 子句的作用是筛选满足条件的组,即在分组之后过滤数据,对GROUP BY对象进行筛选,having条件中经常包含聚组函数,使用having 条件过滤出特定的组。
举栗3:查找员工人数大于30000的部门
SELECT de.dept_name AS 部门,count( de.emp_no ) AS 人数 FROM dept_emp de WHERE de.to_date = '9999-01-01' GROUP BY de.dept_no HAVING count( de.emp_no ) > 30000 .