本帖最后由 myskya 于 2019-12-9 11:28 编辑 $ [+ H6 a- P7 d3 m" p3 m
问题描述/ n: d3 v$ T, D: k& o* V
查询数据经常需要对数据表的某一属性进行去重操作,group by 和 distinct 都有去重功能,但是有区别。 ! @" q' d0 V& K; |8 ]
1.数据去重样例样例数据表 quancheng_test
7 r8 @5 p j3 L! F7 T! @6 p9 k9 i# Q/ T- k: u
功能需求:按 name 进行去重,把 id 查出来。$ A$ {+ m& U; e/ _9 }0 n5 y
方案1: - select id from table group by name;
复制代码结果1:
/ N8 b* |% c; p. i5 Q/ i5 N1 _
3 ?$ p& ]. L" f; w4 X5 Y方案2: - select id, count(distinct name) from quancheng_test group by name;
复制代码结果2: 6 E+ c$ `% k6 L. {
8 @/ r, @( @# ~
2.两种去重方案的区别group 是按组查询的,是一种聚合查询,很多时候是为了做统计用,例如:0 v, B1 H, N% p3 a
对 name 分组,并统计每组 id 的和, - select sum(id), name from quancheng_test group by name;
复制代码查询结果为:
4 t" B! w" q7 S- b
) a# E& |; I/ S* ~! }, R+ Pdistinct 是查询出来以后再把重复的去掉
, z/ Y1 Z' ?% \& S1 `0 Q: t性能上 group 比 distinct 要好很多
8 b/ P8 r+ L P9 w" o% z Z
$ ?% i4 b6 G0 R2 e9 d- P |