本帖最后由 myskya 于 2019-12-9 11:28 编辑 H& N. z- x1 w% @
问题描述
7 D2 L) B" M- l9 S& e- |查询数据经常需要对数据表的某一属性进行去重操作,group by 和 distinct 都有去重功能,但是有区别。
R; K- ^3 K: H0 q2 z" o* h1.数据去重样例样例数据表 quancheng_test
) y% k9 T! l1 @, R; q& `$ D5 d! `% n5 H2 x. W, n
功能需求:按 name 进行去重,把 id 查出来。6 R& g/ T% g: w0 Y R: d5 a# j" k
方案1: - select id from table group by name;
复制代码结果1:
) U q$ A2 w6 P: A p! b& ~* A, e5 ^8 _5 A
方案2: - select id, count(distinct name) from quancheng_test group by name;
复制代码结果2: : G4 l& |( P( ~3 U0 Z
W6 W9 z$ k9 A" V v
2.两种去重方案的区别group 是按组查询的,是一种聚合查询,很多时候是为了做统计用,例如:
0 f# V5 f& H7 s) A对 name 分组,并统计每组 id 的和, - select sum(id), name from quancheng_test group by name;
复制代码查询结果为: ; K3 o0 [+ V2 z# i6 h
; Y& h: ^5 b7 K- sdistinct 是查询出来以后再把重复的去掉
3 J0 T- E# j0 C( C性能上 group 比 distinct 要好很多 % S: L2 o" u4 M# J
' i2 I. _6 q# f% o# C# g( p! B |