本帖最后由 myskya 于 2019-12-9 11:28 编辑 3 S5 W9 O) A+ R( a( o
问题描述. w# n8 G4 Y+ u+ d2 t8 o H, g0 X# Y$ o
查询数据经常需要对数据表的某一属性进行去重操作,group by 和 distinct 都有去重功能,但是有区别。
8 @8 S: N! p% D, Y) w" y1.数据去重样例样例数据表 quancheng_test % m9 Z6 @$ V4 [- ?" V
. @3 E+ Y( e! n# G8 W% t, D功能需求:按 name 进行去重,把 id 查出来。
" R4 ]( W7 Z' z' Z" G" N2 K' J方案1: - select id from table group by name;
复制代码结果1: ) G2 `! r" e% S1 M' N$ @) I( R. K
% q: j" G4 ]5 ]
方案2: - select id, count(distinct name) from quancheng_test group by name;
复制代码结果2:
6 Z9 E, _3 s N! j' f. A! Z! R4 Z3 n+ ]
2.两种去重方案的区别group 是按组查询的,是一种聚合查询,很多时候是为了做统计用,例如:
8 v8 n& ~: ~2 ]+ ]对 name 分组,并统计每组 id 的和, - select sum(id), name from quancheng_test group by name;
复制代码查询结果为:
' q9 v$ ~ @& E
; q. H& I) `/ f8 ?distinct 是查询出来以后再把重复的去掉
7 Z, u* S3 I9 ?) T4 h- l4 K性能上 group 比 distinct 要好很多 ; y% u0 b8 S3 f
( Y I$ G6 w# { |