本帖最后由 myskya 于 2019-12-9 11:28 编辑
2 | Y) }2 |$ C/ s m! i问题描述6 \: U7 g5 ?$ t' T6 E
查询数据经常需要对数据表的某一属性进行去重操作,group by 和 distinct 都有去重功能,但是有区别。 . s6 k; t% d- e: x" `0 O) T
1.数据去重样例样例数据表 quancheng_test . T5 M7 M& G: a4 J
0 w$ V' A$ T, B; J0 q功能需求:按 name 进行去重,把 id 查出来。
g" e6 C) r, \9 L' l方案1: - select id from table group by name;
复制代码结果1:
, l5 S6 U+ Q% i# g4 G! X1 y% @' T; x- L
方案2: - select id, count(distinct name) from quancheng_test group by name;
复制代码结果2:
, ~# ]- S- Y; _/ }1 i Z, G( S; I. ^/ n; W9 [4 _
2.两种去重方案的区别group 是按组查询的,是一种聚合查询,很多时候是为了做统计用,例如:8 v. I8 O/ S9 f6 L7 G
对 name 分组,并统计每组 id 的和, - select sum(id), name from quancheng_test group by name;
复制代码查询结果为: ' B& x- |# P; X( W2 P6 q
- y6 q% }, w8 o2 x5 ~distinct 是查询出来以后再把重复的去掉8 ]0 o, }- `6 m) }% t% ?& `' o
性能上 group 比 distinct 要好很多
$ K+ s+ s6 B" F" y8 ^; H) ]" B) \) m, H
0 A f5 `* }& c Y |