本帖最后由 myskya 于 2019-12-9 11:28 编辑
' [# ?5 r; ~/ }1 d7 `3 X问题描述1 d$ _3 Y; ^- q! _) m
查询数据经常需要对数据表的某一属性进行去重操作,group by 和 distinct 都有去重功能,但是有区别。 7 ~0 I( y, b1 _$ K. r5 Y
1.数据去重样例样例数据表 quancheng_test
/ K7 S/ s6 h% S1 ^) z7 S S0 _) n' [7 P: {
功能需求:按 name 进行去重,把 id 查出来。7 a7 q8 K3 ^, {+ W* O. P
方案1: - select id from table group by name;
复制代码结果1: ' t# E+ ^% ]# _
$ y" X% R7 }* B5 j- @ X2 Y方案2: - select id, count(distinct name) from quancheng_test group by name;
复制代码结果2:
8 W' V1 q( c6 Z, J' {# r% `0 Y
+ V# N" u; v+ W2.两种去重方案的区别group 是按组查询的,是一种聚合查询,很多时候是为了做统计用,例如:
( `1 T' ^) F0 F& [' Q! x对 name 分组,并统计每组 id 的和, - select sum(id), name from quancheng_test group by name;
复制代码查询结果为:
# v) G# ?$ ^& ~* J4 p2 I7 ^5 z" i. [$ l8 u0 \, f
distinct 是查询出来以后再把重复的去掉
4 y# ?6 B# j0 K, U5 s- j1 A性能上 group 比 distinct 要好很多
- h$ s* N# a; O$ I8 l
; K8 c" L; F& A5 |$ B$ h |