本帖最后由 myskya 于 2019-12-9 11:28 编辑 - S4 Y# K& N2 A9 F
问题描述" k/ j+ r4 K- V+ R7 v$ a
查询数据经常需要对数据表的某一属性进行去重操作,group by 和 distinct 都有去重功能,但是有区别。 3 B6 j7 u" R) Z( V. S
1.数据去重样例样例数据表 quancheng_test
- t9 t$ O: a, r* J
$ F$ C8 z2 `" U5 Z5 q0 B功能需求:按 name 进行去重,把 id 查出来。. \- |3 Z |9 q, \: V" |
方案1: - select id from table group by name;
复制代码结果1:
: J# X' T* U( ]- s/ G G. N4 c j0 J4 w' Y. a! [3 l
方案2: - select id, count(distinct name) from quancheng_test group by name;
复制代码结果2: ! O# n5 l* S+ `' w
5 L) ~) U1 q9 Y- ?6 G" k* m- x2.两种去重方案的区别group 是按组查询的,是一种聚合查询,很多时候是为了做统计用,例如:# f [% T# q9 S3 L# e5 c
对 name 分组,并统计每组 id 的和, - select sum(id), name from quancheng_test group by name;
复制代码查询结果为: X- e# k( E! o8 {$ O! M7 H6 R
+ ^* g; e8 \& H% Ddistinct 是查询出来以后再把重复的去掉5 Q6 s7 _; M% ~/ ]% R/ F
性能上 group 比 distinct 要好很多
# |- n, M; O/ F+ A: D$ j% T
% ~3 H' [# D: c. k+ u1 X |