本帖最后由 myskya 于 2019-12-9 11:28 编辑
0 S, m& {. Q$ R& ~% T问题描述1 i, A; a; r! l S
查询数据经常需要对数据表的某一属性进行去重操作,group by 和 distinct 都有去重功能,但是有区别。 % g, h0 p R H- S3 W4 \5 t
1.数据去重样例样例数据表 quancheng_test 3 q$ e$ n* y, Q6 g" A L0 T
, ^1 ^) i0 A% t" M2 X2 e+ b9 D1 V# N% A
功能需求:按 name 进行去重,把 id 查出来。% @/ h4 f) Y2 p8 q: y4 s# ?
方案1: - select id from table group by name;
复制代码结果1: % D/ y& U, M& w: Q; X$ Z
8 ^7 e, e* h* H) `方案2: - select id, count(distinct name) from quancheng_test group by name;
复制代码结果2:
+ p& b' C) c9 ^+ y+ A* t# I w) k3 x0 M9 ~
2.两种去重方案的区别group 是按组查询的,是一种聚合查询,很多时候是为了做统计用,例如:
9 z+ N0 _ M# G! _) P对 name 分组,并统计每组 id 的和, - select sum(id), name from quancheng_test group by name;
复制代码查询结果为: . n1 l+ M0 ?: |: q+ h* R% d$ g/ l6 H
- B3 H% z& O% Bdistinct 是查询出来以后再把重复的去掉
$ L' C& v+ d( F; O6 h( O1 Q性能上 group 比 distinct 要好很多 5 r5 c: K% X4 k# E
- Z. F( q3 T9 L/ H6 f+ J |