本帖最后由 myskya 于 2019-12-9 11:28 编辑
5 X( B: [. `6 `问题描述
& t' Y* T8 L1 u0 [0 U查询数据经常需要对数据表的某一属性进行去重操作,group by 和 distinct 都有去重功能,但是有区别。 4 z. z3 I/ |3 s) t0 N
1.数据去重样例样例数据表 quancheng_test
* |! V+ O5 S2 u' @% L/ C R1 X/ V" k' [8 o
功能需求:按 name 进行去重,把 id 查出来。. Z. ^. \' Y4 }9 ` C
方案1: - select id from table group by name;
复制代码结果1: 7 `" D' B6 R- r
v* @# M& n- w" _
方案2: - select id, count(distinct name) from quancheng_test group by name;
复制代码结果2:
0 u2 Y1 g3 a5 ]2 E0 c' }5 \" F3 G* M) { P5 @) o
2.两种去重方案的区别group 是按组查询的,是一种聚合查询,很多时候是为了做统计用,例如:4 S; @% H9 S2 {
对 name 分组,并统计每组 id 的和, - select sum(id), name from quancheng_test group by name;
复制代码查询结果为:
+ l+ c; E6 y C) `! R1 O% e! Z
; e. l* z; q1 C* D4 O% D5 q5 i8 Bdistinct 是查询出来以后再把重复的去掉7 Y& ?# `2 U' H% G, O
性能上 group 比 distinct 要好很多 : W4 ]1 X* y: h; Q
) _# O: R) Q1 j l3 Q; C9 q# U
|