本帖最后由 myskya 于 2019-12-9 11:28 编辑 : p* B( l. a& M/ M3 m
问题描述/ }; L0 w. j* x: }7 Y: r
查询数据经常需要对数据表的某一属性进行去重操作,group by 和 distinct 都有去重功能,但是有区别。
" P8 N* }- h q/ G9 v. V1.数据去重样例样例数据表 quancheng_test
8 `7 @4 y5 u6 x9 o, O$ q- _. B* }/ E' ?
功能需求:按 name 进行去重,把 id 查出来。' h! u+ L" _ R4 M, g
方案1: - select id from table group by name;
复制代码结果1:
2 N( ^1 Z- |2 K: _7 P$ v6 [( c5 m6 Q8 f
方案2: - select id, count(distinct name) from quancheng_test group by name;
复制代码结果2: Q* S4 h0 p: ^+ l# t
# |/ W; a0 d) G2 g
2.两种去重方案的区别group 是按组查询的,是一种聚合查询,很多时候是为了做统计用,例如:* D0 J% b; F, p Z- U" N/ f9 X' e" }
对 name 分组,并统计每组 id 的和, - select sum(id), name from quancheng_test group by name;
复制代码查询结果为:
6 r- J5 m$ y4 X0 o: d$ V2 x6 c- X1 s: m. `
distinct 是查询出来以后再把重复的去掉
) `+ V- l. j' E: Q. z% |* U3 h9 N性能上 group 比 distinct 要好很多
* T3 w& Q9 W$ B9 ~
3 K$ k! p' }4 d, N, W% Z |