本帖最后由 myskya 于 2019-12-9 11:28 编辑 # H: B9 v& h& t
问题描述) u3 x) a: @# J8 `
查询数据经常需要对数据表的某一属性进行去重操作,group by 和 distinct 都有去重功能,但是有区别。
7 X4 E% z6 x; c/ \$ L1.数据去重样例样例数据表 quancheng_test
8 F, Q" \ {; l! ] d* P/ s7 U4 w# l. f# N) O
功能需求:按 name 进行去重,把 id 查出来。
6 G) w5 `+ o8 }0 l0 y# V" J方案1: - select id from table group by name;
复制代码结果1: ; O* S. b3 _) H m; B7 N; B
; V/ k0 S; e; z% O& u" a方案2: - select id, count(distinct name) from quancheng_test group by name;
复制代码结果2:
; [% R7 \5 Z- F! l# T
& e4 ?( z7 z% K8 d# c4 c* M7 L1 P2.两种去重方案的区别group 是按组查询的,是一种聚合查询,很多时候是为了做统计用,例如:" B9 }4 I7 e' q0 f- p4 \" p
对 name 分组,并统计每组 id 的和, - select sum(id), name from quancheng_test group by name;
复制代码查询结果为: ! O& C) U6 ~ c
& K# Y( _2 b+ Y* j% R) i. rdistinct 是查询出来以后再把重复的去掉
+ \2 E# r# p& H* S性能上 group 比 distinct 要好很多 1 k) b. S" W& J- z
6 @6 e& z2 H: r* ?. X) S8 _ |