本帖最后由 myskya 于 2019-12-9 11:28 编辑
: x5 t) h) g. a- [+ v问题描述8 L" Z; M' |! |; U7 v
查询数据经常需要对数据表的某一属性进行去重操作,group by 和 distinct 都有去重功能,但是有区别。
5 j7 X! ~/ S! H$ j8 W. w# E! j1.数据去重样例样例数据表 quancheng_test
8 N$ H8 m" q7 B& p1 R6 ^5 D$ z# w4 ~% }- L
功能需求:按 name 进行去重,把 id 查出来。
4 Y6 T8 d- v7 Y) A方案1: - select id from table group by name;
复制代码结果1: 8 b3 e0 e( x1 k9 R" b( e& m
3 \6 J4 j. T6 Q8 W' R6 \1 Y方案2: - select id, count(distinct name) from quancheng_test group by name;
复制代码结果2: % Q. d6 N9 f1 S! d& k6 h
$ N; T7 q6 i# k. v7 }" v2 [2.两种去重方案的区别group 是按组查询的,是一种聚合查询,很多时候是为了做统计用,例如:
! E7 l( j! d% r对 name 分组,并统计每组 id 的和, - select sum(id), name from quancheng_test group by name;
复制代码查询结果为: & p) [5 H+ ?# E8 C& p( K
- Z8 K) }2 ]% x0 l `
distinct 是查询出来以后再把重复的去掉
* Y- ~8 j% h; ]& ~性能上 group 比 distinct 要好很多 * ] }8 [# B6 _- v B& A. s
' T; e; `1 g; u. S5 A
|