本帖最后由 myskya 于 2019-12-9 11:28 编辑
, c2 k/ a! ]& ] D8 N问题描述0 s6 ^1 A; Z/ P' R* F' \
查询数据经常需要对数据表的某一属性进行去重操作,group by 和 distinct 都有去重功能,但是有区别。
! @- e6 }3 \, b' _: X: q# K. l1.数据去重样例样例数据表 quancheng_test
) M$ Y+ l1 L; ~; D; Y3 s9 `! T& j. u
功能需求:按 name 进行去重,把 id 查出来。! X# T& u1 k: S+ {" Z6 K! f5 ]
方案1: - select id from table group by name;
复制代码结果1:
, T' X) b9 ]' g8 W: m; \
3 k7 n5 x5 N5 x- `方案2: - select id, count(distinct name) from quancheng_test group by name;
复制代码结果2: 9 |5 q6 ]& d8 G/ D
% o/ w* k- O, A2 B; }! I7 |
2.两种去重方案的区别group 是按组查询的,是一种聚合查询,很多时候是为了做统计用,例如:
1 K6 z) u" e4 e- w对 name 分组,并统计每组 id 的和, - select sum(id), name from quancheng_test group by name;
复制代码查询结果为: + v# Q( J0 ^8 f1 D; {. w
# o1 L/ x0 c; t1 ?5 {5 T
distinct 是查询出来以后再把重复的去掉
2 W3 O6 o0 z2 x# C, P9 c3 c' p0 ]* N性能上 group 比 distinct 要好很多 2 z$ p4 N- f8 V/ m, w
! B( J* b( r' H8 a9 e5 x+ q3 ]& Y |