MySQL去重該使用distinct還是group by?
前言
關(guān)于group by 與distinct 性能對比:網(wǎng)上結(jié)論如下,不走索引少量數(shù)據(jù)distinct性能更好,大數(shù)據(jù)量group by 性能好,走索引group by性能好。走索引時(shí)分組種類少distinct快。關(guān)于網(wǎng)上的結(jié)論做一次驗(yàn)證。
準(zhǔn)備階段屏蔽查詢緩存
查看MySQL中是否設(shè)置了查詢緩存。為了不影響測試結(jié)果,需要關(guān)閉查詢緩存。
show variables like ’%query_cache%’;
查看是否開啟查詢緩存決定于query_cache_type和query_cache_size。
方法一:關(guān)閉查詢緩存需要找到my.ini,修改query_cache_type需要修改C:ProgramDataMySQLMySQL Server 5.7my.ini配置文件,修改query_cache_type=0或2。 方法二:設(shè)置query_cache_size為0,執(zhí)行以下語句。set global query_cache_size = 0;
方法三:如果你不想關(guān)閉查詢緩存,也可以在使用RESET QUERY CACHE。
現(xiàn)在測試環(huán)境中query_cache_type=2代表按需進(jìn)行查詢緩存,默認(rèn)的查詢方式是不會(huì)進(jìn)行緩存,如需緩存則需要在查詢語句中加上sql_cache。
數(shù)據(jù)準(zhǔn)備
t0表存放10W少量種類少的數(shù)據(jù)
drop table if exists t0;create table t0(id bigint primary key auto_increment,a varchar(255) not null) engine=InnoDB default charset=utf8mb4 collate=utf8mb4_bin;12345drop procedure insert_t0_simple_category_data_sp;delimiter //create procedure insert_t0_simple_category_data_sp(IN num int)beginset @i = 0;while @i < num doinsert into t0(a) value(truncate(@i/1000, 0)); set @i = @i + 1;end while;end//call insert_t0_simple_category_data_sp(100000);
t1表存放1W少量種類多的數(shù)據(jù)
drop table if exists t1;create table t1 like t0;12drop procedure insert_t1_complex_category_data_sp;delimiter //create procedure insert_t1_complex_category_data_sp(IN num int)beginset @i = 0;while @i < num doinsert into t1(a) value(truncate(@i/10, 0)); set @i = @i + 1;end while;end//call insert_t1_complex_category_data_sp(10000);
t2表存放500W大量種類多的數(shù)據(jù)
drop table if exists t2;create table t2 like t1;12drop procedure insert_t2_complex_category_data_sp;delimiter //create procedure insert_t2_complex_category_data_sp(IN num int)beginset @i = 0;while @i < num doinsert into t1(a) value(truncate(@i/10, 0)); set @i = @i + 1;end while;end//call insert_t2_complex_category_data_sp(5000000);
測試階段
驗(yàn)證少量種類少數(shù)據(jù)
未加索引
set profiling = 1;select distinct a from t0;show profiles;select a from t0 group by a;show profiles;alter table t0 add index `a_t0_index`(a);
由此可見:少量種類少數(shù)據(jù)下,未加索引,distinct和group by性能相差無幾。
加索引
alter table t0 add index `a_t0_index`(a);
執(zhí)行上述類似查詢后
由此可見:少量種類少數(shù)據(jù)下,加索引,distinct和group by性能相差無幾。
驗(yàn)證少量種類多數(shù)據(jù)未加索引
執(zhí)行上述類似未加索引查詢后
由此可見:少量種類多數(shù)據(jù)下,未加索引,distinct比group by性能略高,差距并不大。
加索引
alter table t1 add index `a_t1_index`(a);
執(zhí)行類似未加索引查詢后
由此可見:少量種類多數(shù)據(jù)下,加索引,distinct和group by性能相差無幾。
驗(yàn)證大量種類多數(shù)據(jù)
未加索引
SELECT count(1) FROM t2;
執(zhí)行上述類似未加索引查詢后
由此可見:大量種類多數(shù)據(jù)下,未加索引,distinct比group by性能高。
加索引
alter table t2 add index `a_t2_index`(a);
執(zhí)行上述類似加索引查詢后
由此可見:大量種類多數(shù)據(jù)下,加索引,distinct和group by性能相差無幾。
總結(jié)性能比少量種類少少量種類多大量種類多未加索引相差無幾distinct略優(yōu)distinct更優(yōu)加索引相差無幾相差無幾相差無幾
去重場景下,未加索引時(shí),更偏向于使用distinct,而加索引時(shí),distinct和group by兩者都可以使用。
總結(jié)
到此這篇關(guān)于MySQL去重該使用distinct還是group by?的文章就介紹到這了,更多相關(guān)mysql 去重distinct group by內(nèi)容請搜索好吧啦網(wǎng)以前的文章或繼續(xù)瀏覽下面的相關(guān)文章希望大家以后多多支持好吧啦網(wǎng)!
相關(guān)文章:
1. debian10 mariadb安裝過程詳解2. MYSQL(電話號碼,身份證)數(shù)據(jù)脫敏的實(shí)現(xiàn)3. Oracle rac環(huán)境的數(shù)據(jù)庫導(dǎo)入操作步驟4. 根據(jù)IP跳轉(zhuǎn)到用戶所在城市的實(shí)現(xiàn)步驟5. Windows系統(tǒng)徹底卸載SQL Server通用方法(推薦!)6. mysql查詢的控制語句圖文詳解7. Mysql中的日期時(shí)間函數(shù)小結(jié)8. Sql在多張表中檢索數(shù)據(jù)的方法詳解9. Windows10環(huán)境安裝sdk8的圖文教程10. SQL Server2022安裝圖文教程(最新推薦)
