本帖最后由 myskya 于 2019-12-9 11:28 编辑
2 V% |" z/ K, Y+ p问题描述
; ]* a, [: o4 ?2 R& G4 ?- P. t5 R查询数据经常需要对数据表的某一属性进行去重操作,group by 和 distinct 都有去重功能,但是有区别。 5 T* K' i2 J p- K% S5 Z: z
1.数据去重样例样例数据表 quancheng_test $ L- Q. }$ y: [) o
8 M/ p! l1 d9 N8 m( r
功能需求:按 name 进行去重,把 id 查出来。
* ?: |0 ^" [" d8 q' X方案1: - select id from table group by name;
复制代码结果1:
1 |$ P- s: Q" W1 [; J8 n. G* Y9 P$ U( l8 K
方案2: - select id, count(distinct name) from quancheng_test group by name;
复制代码结果2: # p j# Z( \( X1 L/ |
0 `" E5 v, w+ H8 f" m2 q2.两种去重方案的区别group 是按组查询的,是一种聚合查询,很多时候是为了做统计用,例如:, {$ o Q5 p, L# G0 U4 V$ H
对 name 分组,并统计每组 id 的和, - select sum(id), name from quancheng_test group by name;
复制代码查询结果为:
9 k- D1 R$ [* n, b% N3 Q7 d5 R9 Z. A/ d$ M4 Z5 ]
distinct 是查询出来以后再把重复的去掉
$ s+ }$ i! _. Y) Q3 d5 e性能上 group 比 distinct 要好很多 1 q: V9 @! o8 R) U
/ M, _3 `( @% N$ E x( A" i |