国产探花免费观看_亚洲丰满少妇自慰呻吟_97日韩有码在线_资源在线日韩欧美_一区二区精品毛片,辰东完美世界有声小说,欢乐颂第一季,yy玄幻小说排行榜完本

首頁 > 數(shù)據(jù)庫 > MySQL > 正文

MySQL批量數(shù)據(jù)插入SQL性能優(yōu)化

2024-07-24 13:04:57
字體:
供稿:網(wǎng)友

對于一些數(shù)據(jù)量較大的系統(tǒng),數(shù)據(jù)庫面臨的問題除了查詢效率低下,還有就是數(shù)據(jù)入庫時間長。特別像報表系統(tǒng),每天花費在數(shù)據(jù)導入上的時間可能會長達幾個小時或十幾個小時之久。因此,優(yōu)化數(shù)據(jù)庫插入性能是很有意義的。

經(jīng)過對MySQL innodb的一些性能測試,發(fā)現(xiàn)一些可以提高insert效率的方法,供大家參考參考。

1. 一條SQL語句插入多條數(shù)據(jù)。

常用的插入語句如:

INSERT INTO `insert_table` (`datetime`, `uid`, `content`, `type`) VALUES ('0', 'userid_0', 'content_0', 0);INSERT INTO `insert_table` (`datetime`, `uid`, `content`, `type`) VALUES ('1', 'userid_1', 'content_1', 1);

修改成:

INSERT INTO `insert_table` (`datetime`, `uid`, `content`, `type`) VALUES ('0', 'userid_0', 'content_0', 0), ('1', 'userid_1', 'content_1', 1);

修改后的插入操作能夠提高程序的插入效率。這里第二種SQL執(zhí)行效率高的主要原因是合并后日志量(MySQL的binlog和innodb的事務讓日志)減少了,降低日志刷盤的數(shù)據(jù)量和頻率,從而提高效率。通過合并SQL語句,同時也能減少SQL語句解析的次數(shù),減少網(wǎng)絡傳輸?shù)腎O。

這里提供一些測試對比數(shù)據(jù),分別是進行單條數(shù)據(jù)的導入與轉(zhuǎn)化成一條SQL語句進行導入,分別測試1百、1千、1萬條數(shù)據(jù)記錄。

MySQL批量數(shù)據(jù)插入SQL性能優(yōu)化

2. 在事務中進行插入處理。

把插入修改成:

START TRANSACTION;INSERT INTO `insert_table` (`datetime`, `uid`, `content`, `type`) VALUES ('0', 'userid_0', 'content_0', 0);INSERT INTO `insert_table` (`datetime`, `uid`, `content`, `type`) VALUES ('1', 'userid_1', 'content_1', 1);...COMMIT;

使用事務可以提高數(shù)據(jù)的插入效率,這是因為進行一個INSERT操作時,MySQL內(nèi)部會建立一個事務,在事務內(nèi)才進行真正插入處理操作。通過使用事務可以減少創(chuàng)建事務的消耗,所有插入都在執(zhí)行后才進行提交操作。

這里也提供了測試對比,分別是不使用事務與使用事務在記錄數(shù)為1百、1千、1萬的情況。

MySQL批量數(shù)據(jù)插入SQL性能優(yōu)化

3. 數(shù)據(jù)有序插入。

數(shù)據(jù)有序的插入是指插入記錄在主鍵上是有序排列,例如datetime是記錄的主鍵:

INSERT INTO `insert_table` (`datetime`, `uid`, `content`, `type`) VALUES ('1', 'userid_1', 'content_1', 1);INSERT INTO `insert_table` (`datetime`, `uid`, `content`, `type`) VALUES ('0', 'userid_0', 'content_0', 0);INSERT INTO `insert_table` (`datetime`, `uid`, `content`, `type`) VALUES ('2', 'userid_2', 'content_2',2);

修改成:

INSERT INTO `insert_table` (`datetime`, `uid`, `content`, `type`) VALUES ('0', 'userid_0', 'content_0', 0);INSERT INTO `insert_table` (`datetime`, `uid`, `content`, `type`) VALUES ('1', 'userid_1', 'content_1', 1);INSERT INTO `insert_table` (`datetime`, `uid`, `content`, `type`) VALUES ('2', 'userid_2', 'content_2',2);

由于數(shù)據(jù)庫插入時,需要維護索引數(shù)據(jù),無序的記錄會增大維護索引的成本。我們可以參照innodb使用的B+tree索引,如果每次插入記錄都在索引的最后面,索引的定位效率很高,并且對索引調(diào)整較小;如果插入的記錄在索引中間,需要B+tree進行分裂合并等處理,會消耗比較多計算資源,并且插入記錄的索引定位效率會下降,數(shù)據(jù)量較大時會有頻繁的磁盤操作。

下面提供隨機數(shù)據(jù)與順序數(shù)據(jù)的性能對比,分別是記錄為1百、1千、1萬、10萬、100萬。

MySQL批量數(shù)據(jù)插入SQL性能優(yōu)化

從測試結(jié)果來看,該優(yōu)化方法的性能有所提高,但是提高并不是很明顯。

 

性能綜合測試:

這里提供了同時使用上面三種方法進行INSERT效率優(yōu)化的測試。

MySQL批量數(shù)據(jù)插入SQL性能優(yōu)化

從測試結(jié)果可以看到,合并數(shù)據(jù)+事務的方法在較小數(shù)據(jù)量時,性能提高是很明顯的,數(shù)據(jù)量較大時(1千萬以上),性能會急劇下降,這是由于此時數(shù)據(jù)量超過了innodb_buffer的容量,每次定位索引涉及較多的磁盤讀寫操作,性能下降較快。而使用合并數(shù)據(jù)+事務+有序數(shù)據(jù)的方式在數(shù)據(jù)量達到千萬級以上表現(xiàn)依舊是良好,在數(shù)據(jù)量較大時,有序數(shù)據(jù)索引定位較為方便,不需要頻繁對磁盤進行讀寫操作,所以可以維持較高的性能。

 

注意事項:

1. SQL語句是有長度限制,在進行數(shù)據(jù)合并在同一SQL中務必不能超過SQL長度限制,通過max_allowed_packet配置可以修改,默認是1M,測試時修改為8M。

2. 事務需要控制大小,事務太大可能會影響執(zhí)行的效率。MySQL有innodb_log_buffer_size配置項,超過這個值會把innodb的數(shù)據(jù)刷到磁盤中,這時,效率會有所下降。所以比較好的做法是,在數(shù)據(jù)達到這個這個值前進行事務提交。

發(fā)表評論 共有條評論
用戶名: 密碼:
驗證碼: 匿名發(fā)表
主站蜘蛛池模板: 漾濞| 佛坪县| 莲花县| 华安县| 香格里拉县| 沁水县| 都兰县| 巴楚县| 镇康县| 宁夏| 临汾市| 扶风县| 安泽县| 剑河县| 额敏县| 东台市| 武强县| 武威市| 施甸县| 隆昌县| 兰考县| 开封县| 额尔古纳市| 汉沽区| 潜江市| 察哈| 辰溪县| 盈江县| 晋城| 当涂县| 平果县| 云龙县| 西乌| 安多县| 泾川县| 竹山县| 射阳县| 新和县| 沾化县| 大宁县| 通山县|