主頁 > 知識庫 > MySQL去重該使用distinct還是group by?

MySQL去重該使用distinct還是group by?

熱門標簽:400電話到哪辦理優(yōu)惠 鄭州網(wǎng)絡外呼系統(tǒng)價錢 怎么更改高德地圖標注 電話機器人是電腦呼號嗎 云南大數(shù)據(jù)外呼系統(tǒng) 上海市三維地圖標注 博樂電銷機器人 南寧外呼系統(tǒng)招商 機器人打電銷電話

前言

關于group by 與distinct 性能對比:網(wǎng)上結(jié)論如下,不走索引少量數(shù)據(jù)distinct性能更好,大數(shù)據(jù)量group by 性能好,走索引group by性能好。走索引時分組種類少distinct快。關于網(wǎng)上的結(jié)論做一次驗證。

準備階段屏蔽查詢緩存

查看MySQL中是否設置了查詢緩存。為了不影響測試結(jié)果,需要關閉查詢緩存。

show variables like '%query_cache%';

查看是否開啟查詢緩存決定于query_cache_typequery_cache_size

  • 方法一:關閉查詢緩存需要找到my.ini,修改query_cache_type需要修改C:\ProgramData\MySQL\MySQL Server 5.7\my.ini配置文件,修改query_cache_type=0或2
  • 方法二:設置query_cache_size為0,執(zhí)行以下語句。
set global query_cache_size = 0;

方法三:如果你不想關閉查詢緩存,也可以在使用RESET QUERY CACHE。

現(xiàn)在測試環(huán)境中query_cache_type=2代表按需進行查詢緩存,默認的查詢方式是不會進行緩存,如需緩存則需要在查詢語句中加上sql_cache

數(shù)據(jù)準備

t0表存放10W少量種類少的數(shù)據(jù)

drop table if exists t0;
create table t0(
id bigint primary key auto_increment,
a varchar(255) not null
) engine=InnoDB default charset=utf8mb4 collate=utf8mb4_bin;
1
2
3
4
5
drop procedure insert_t0_simple_category_data_sp;
delimiter //
create procedure insert_t0_simple_category_data_sp(IN num int)
begin
set @i = 0;
while @i  num do
	insert into t0(a) value(truncate(@i/1000, 0));
 set @i = @i + 1;
end while;
end
//
call insert_t0_simple_category_data_sp(100000);

t1表存放1W少量種類多的數(shù)據(jù)

drop table if exists t1;
create table t1 like t0;
1
2
drop procedure insert_t1_complex_category_data_sp;
delimiter //
create procedure insert_t1_complex_category_data_sp(IN num int)
begin
set @i = 0;
while @i  num do
	insert into t1(a) value(truncate(@i/10, 0));
 set @i = @i + 1;
end while;
end
//
call insert_t1_complex_category_data_sp(10000);

t2表存放500W大量種類多的數(shù)據(jù)

drop table if exists t2;
create table t2 like t1;
1
2
drop procedure insert_t2_complex_category_data_sp;
delimiter //
create procedure insert_t2_complex_category_data_sp(IN num int)
begin
set @i = 0;
while @i  num do
	insert into t1(a) value(truncate(@i/10, 0));
 set @i = @i + 1;
end while;
end
//
call insert_t2_complex_category_data_sp(5000000);

測試階段

驗證少量種類少數(shù)據(jù)

未加索引

set profiling = 1;
select distinct a from t0;
show profiles;
select a from t0 group by a;
show profiles;
alter table t0 add index `a_t0_index`(a);

由此可見:少量種類少數(shù)據(jù)下,未加索引,distinct和group by性能相差無幾。

加索引

alter table t0 add index `a_t0_index`(a);

執(zhí)行上述類似查詢后

由此可見:少量種類少數(shù)據(jù)下,加索引,distinct和group by性能相差無幾。

驗證少量種類多數(shù)據(jù)未加索引

執(zhí)行上述類似未加索引查詢后

由此可見:少量種類多數(shù)據(jù)下,未加索引,distinct比group by性能略高,差距并不大。

加索引

alter table t1 add index `a_t1_index`(a);

執(zhí)行類似未加索引查詢后

由此可見:少量種類多數(shù)據(jù)下,加索引,distinct和group by性能相差無幾。

驗證大量種類多數(shù)據(jù)

未加索引

SELECT count(1) FROM t2;


執(zhí)行上述類似未加索引查詢后


由此可見:大量種類多數(shù)據(jù)下,未加索引,distinct比group by性能高。

加索引

alter table t2 add index `a_t2_index`(a);

執(zhí)行上述類似加索引查詢后

由此可見:大量種類多數(shù)據(jù)下,加索引,distinct和group by性能相差無幾。

總結(jié)

性能比 少量種類少 少量種類多 大量種類多未加索引相差無幾distinct略優(yōu)distinct更優(yōu)加索引相差無幾相差無幾相差無幾

去重場景下,未加索引時,更偏向于使用distinct,而加索引時,distinct和group by兩者都可以使用。

總結(jié)

到此這篇關于MySQL去重該使用distinct還是group by?的文章就介紹到這了,更多相關mysql 去重distinct group by內(nèi)容請搜索腳本之家以前的文章或繼續(xù)瀏覽下面的相關文章希望大家以后多多支持腳本之家!

您可能感興趣的文章:
  • MySQL優(yōu)化GROUP BY(松散索引掃描與緊湊索引掃描)
  • MySQL優(yōu)化GROUP BY方案
  • mysql group by 對多個字段進行分組操作
  • 基于mysql實現(xiàn)group by取各分組最新一條數(shù)據(jù)
  • Mysql5.7及以上版本 ONLY_FULL_GROUP_BY報錯的解決方法
  • MySQL中使用group by 是總是出現(xiàn)1055的錯誤(推薦)
  • mysql case when group by 實例詳解
  • Mysql升級到5.7后遇到的group by查詢問題解決
  • MySQL group by語句如何優(yōu)化

標簽:白銀 恩施 秦皇島 定西 澳門 杭州 益陽 寧夏

巨人網(wǎng)絡通訊聲明:本文標題《MySQL去重該使用distinct還是group by?》,本文關鍵詞  MySQL,去重,該,使用,distinct,;如發(fā)現(xiàn)本文內(nèi)容存在版權(quán)問題,煩請?zhí)峁┫嚓P信息告之我們,我們將及時溝通與處理。本站內(nèi)容系統(tǒng)采集于網(wǎng)絡,涉及言論、版權(quán)與本站無關。
  • 相關文章
  • 下面列出與本文章《MySQL去重該使用distinct還是group by?》相關的同類信息!
  • 本頁收集關于MySQL去重該使用distinct還是group by?的相關信息資訊供網(wǎng)民參考!
  • 推薦文章