本帖最后由 myskya 于 2019-12-9 11:28 编辑 / Y3 ~8 I z! h5 O9 I
问题描述$ m$ V! e8 U5 y1 c1 [0 ]5 j# w
查询数据经常需要对数据表的某一属性进行去重操作,group by 和 distinct 都有去重功能,但是有区别。
2 }. |$ B! ]. a2 v& o5 N# S7 C w1.数据去重样例样例数据表 quancheng_test " z5 {& p& @' J- r6 R$ ?, u0 b
; u; P, _) G3 Y+ H" E
功能需求:按 name 进行去重,把 id 查出来。0 |' C! G( W: b" ^
方案1: - select id from table group by name;
复制代码结果1:
7 j7 g. W) X( ]7 o4 I; L2 K; G
& E, e- i/ a, P方案2: - select id, count(distinct name) from quancheng_test group by name;
复制代码结果2:
! n( T, k8 d. w: u+ S; J9 v% ^: X9 C5 e' l" y) k: ^: {# {1 u( |
2.两种去重方案的区别group 是按组查询的,是一种聚合查询,很多时候是为了做统计用,例如:8 j9 t% r# ~# J( w \
对 name 分组,并统计每组 id 的和, - select sum(id), name from quancheng_test group by name;
复制代码查询结果为: : g, c$ J9 P) q x0 f
/ V# i6 t, z+ s
distinct 是查询出来以后再把重复的去掉9 ]; N9 Y- t; R% e, ?; @. O9 r3 ]
性能上 group 比 distinct 要好很多 : K8 O' |* U" D: F+ P4 U3 I) U' F' f
9 B4 t+ v( u5 Z) U. [
|