本帖最后由 myskya 于 2019-12-9 11:28 编辑
+ k$ ]+ [" |0 `# B- k问题描述
# S! K2 V. R9 Z" Z. r# e查询数据经常需要对数据表的某一属性进行去重操作,group by 和 distinct 都有去重功能,但是有区别。
2 v% l& J2 q& X# a% g1.数据去重样例样例数据表 quancheng_test
: N- I4 H+ y( F0 H$ ~3 m2 U! x% P) ?$ \ z- ~ h* \# a
功能需求:按 name 进行去重,把 id 查出来。3 _' x: Z+ s+ F# W5 P4 t8 {
方案1: - select id from table group by name;
复制代码结果1:
A& ^7 S- G. A9 ^8 r% Y3 w' z4 u+ e$ j# {1 s
方案2: - select id, count(distinct name) from quancheng_test group by name;
复制代码结果2: $ [$ f5 {1 R3 r; g
5 o% ^+ r9 D! X2 X
2.两种去重方案的区别group 是按组查询的,是一种聚合查询,很多时候是为了做统计用,例如:, x' ?$ E- r" X- d
对 name 分组,并统计每组 id 的和, - select sum(id), name from quancheng_test group by name;
复制代码查询结果为: " b# \3 [, T" X. \' \5 L2 i
6 D+ G: o% [: N( y. e6 g- Udistinct 是查询出来以后再把重复的去掉
" C0 e, x1 K" p- s+ C性能上 group 比 distinct 要好很多 B. V, q/ |; a* [
% F2 Z* g' Y9 F' v
|