本帖最后由 myskya 于 2019-12-9 11:28 编辑 ! S9 v5 ~: @4 k5 m8 a# ]7 w1 _: \
问题描述4 ^# x/ i6 S& }3 G; s5 @
查询数据经常需要对数据表的某一属性进行去重操作,group by 和 distinct 都有去重功能,但是有区别。 - E% Z, F, m5 Z
1.数据去重样例样例数据表 quancheng_test
4 N9 x* E2 ]/ f# Y$ Q- O {3 Y" s& |- E! [
功能需求:按 name 进行去重,把 id 查出来。
5 M% T% g, ]4 Y8 u U方案1: - select id from table group by name;
复制代码结果1:
7 v& H, ~+ K: A4 D7 ~: ]! y* f6 E* j
方案2: - select id, count(distinct name) from quancheng_test group by name;
复制代码结果2:
' |- B- H# d7 d( Q- O4 ?% d. G; [* S4 O1 Y7 L1 G, n* q" x6 c6 J' C
2.两种去重方案的区别group 是按组查询的,是一种聚合查询,很多时候是为了做统计用,例如:9 _" D" Z% c& c+ T/ q* ^' u5 S
对 name 分组,并统计每组 id 的和, - select sum(id), name from quancheng_test group by name;
复制代码查询结果为:
& Q' J3 Z* j6 d9 m5 y; ?* r1 ^4 }/ d. f7 ^1 S4 J B
distinct 是查询出来以后再把重复的去掉
" ]6 x; |4 W% W/ i性能上 group 比 distinct 要好很多 ' \; r9 w. _: f/ {
% R2 E( r& G2 E: ~6 s" c$ E |