Mysql 批量插入事務插入效能對比

阿新 • • 發佈：2019-01-27

對於一些資料量較大的系統，資料庫面臨的問題除了查詢效率低下，還有就是資料入庫時間長。特別像報表系統，可能每天花費在資料匯入上的時間就會長達幾個小時之久。因此，優化資料庫插入效能是很有意義的。

網路上的牛人很多，總會有一些手段可以提高insert效率，大家跟我一起分享一下吧：

1. 一條SQL語句插入多條資料。
我們常用的插入語句大都是一條一個insert，如：

INSERTINTO `insert_table` (`datetime`, `uid`, `content`, `type`)
VALUES ('0', 'userid_0'

, 'content_0', 0);
INSERTINTO `insert_table` (`datetime`, `uid`, `content`, `type`)
VALUES ('1', 'userid_1', 'content_1', 1);

現在我們將它修改成：

INSERT INTO `insert_table` (`datetime`, `uid`, `content`, `type`)
VALUES ('0', 'userid_0', 'content_0', 0), ('1', 'userid_1', 'content_1', 1);

【資料對比】

下面是網上牛人提供一些測試對比資料，分別是進行單條資料的匯入與轉化成一條SQL語句進行匯入，分別測試1百、1千、1萬條資料記錄。通過對比，可以發現修改後的插入操作能夠提高程式的插入效率。

【緣由分析】
這裡第二種SQL執行效率高的主要原因是合併後日志量（MySQL的binlog和innodb的事務讓日誌）減少了，降低日誌刷盤的資料量和頻率，從而提高效率。通過合併SQL語句，同時也能減少SQL語句解析的次數，減少網路傳輸的IO。

2. 在事務中進行插入處理。
在操作資料的時候，事務也是很常用的。現在我們把上面的插入語句修改成：

START TRANSACTION;
INSERTINTO `insert_table` (`datetime`, `uid`, `content`, `type`)
VALUES ('0', 'userid_0', 'content_0', 0);
INSERTINTO `insert_table` (`datetime`, `uid`, `content`, `type`)
VALUES ('1', 'userid_1', 'content_1', 1);
...
COMMIT;

【資料對比】

這裡也提供了測試對比，分別是不使用事務與使用事務在記錄數為1百、1千、1萬的情況。亦發現資料的插入效率提高了。

【緣由分析】

這是因為進行一個INSERT操作時，mysql內部會建立一個事務，在事務內才進行真正插入處理操作。通過使用事務可以減少建立事務的消耗，所有插入都在執行後才進行提交操作。

3. 資料有序插入。

資料有序的插入是指插入記錄在主鍵上是有序排列，例如datetime是記錄的主鍵：

原始插入語句如下：

INSERTINTO `insert_table` (`datetime`, `uid`, `content`, `type`)
VALUES ('1', 'userid_1', 'content_1', 1);
INSERTINTO `insert_table` (`datetime`, `uid`, `content`, `type`)
VALUES ('0', 'userid_0', 'content_0', 0);
INSERTINTO `insert_table` (`datetime`, `uid`, `content`, `type`)
VALUES ('2', 'userid_2', 'content_2',2);

修改成：

INSERTINTO `insert_table` (`datetime`, `uid`, `content`, `type`)
VALUES ('0', 'userid_0', 'content_0', 0);
INSERTINTO `insert_table` (`datetime`, `uid`, `content`, `type`)
VALUES ('1', 'userid_1', 'content_1', 1);
INSERTINTO `insert_table` (`datetime`, `uid`, `content`, `type`)
VALUES ('2', 'userid_2', 'content_2',2);

【資料對比】

下面提供隨機資料與順序資料的效能對比，分別是記錄為1百、1千、1萬、10萬、100萬。從測試結果來看，該優化方法的效能有所提高，但是提高並不是很明顯。

【緣由分析】
由於資料庫插入時，需要維護索引資料，無序的記錄會增大維護索引的成本。我們可以參照innodb使用的B+Tree 索引，如果每次插入記錄都在索引的最後面，索引的定位效率很高，並且對索引調整較小；如果插入的記錄在索引中間，需要B+tree進行分裂合併等處理，會消耗比較多計算資源，並且插入記錄的索引定位效率會下降，資料量較大時會有頻繁的磁碟操作。

效能綜合測試：
這裡提供了同時使用上面三種方法進行INSERT效率優化的測試。

從測試結果可以看到，合併資料+事務的方法在較小資料量時，效能提高是很明顯的，資料量較大時（1千萬以上），效能會急劇下降，這是由於此時資料量超過了innodb_buffer的容量，每次定位索引涉及較多的磁碟讀寫操作，效能下降較快。而使用合併資料+事務+有序資料的方式在資料量達到千萬級以上表現依舊是良好，在資料量較大時，有序資料索引定位較為方便，不需要頻繁對磁碟進行讀寫操作，所以可以維持較高的效能。

注意事項：

- SQL語句是有長度限制，在進行資料合併在同一SQL中務必不能超過SQL長度限制，通過max_allowed_packet配置可以修改，預設是1M，測試時修改為8M。
- 事務需要控制大小，事務太大可能會影響執行的效率。MySQL有innodb_log_buffer_size配置項，超過這個值會把innodb的資料刷到磁碟中，這時，效率會有所下降。所以比較好的做法是，在資料達到這個這個值前進行事務提交。

Mysql 批量插入事務插入效能對比

Mysql 批量插入事務插入效能對比

Java、PHP、Python、Erlang、Golang 千萬級記憶體資料插入、查詢效能對比

Mysql批量更新及插入（引數為Map）

關於Navicat for mysql批量提交事務回滾的問題

MySQL批量SQL插入效能優化

Mysql保持連線和每次重連--以及--迴圈提交和事務形式提交在插入時的耗時對比分析

MYSQL批量插入資料庫實現語句效能分析

MySQL批量千萬級資料SQL插入效能優化

Mybatis+mysql批量插入效能分析測試

MySQL實現批量插入以優化效能的教程

MySQL批量插入效能優化（二）

（轉）MYSQL批量插入資料庫實現語句效能分析

MySQL批量插入，，SQL插入效能優化

mysql 批量插入與單條插入的效率比較

MySQL批量SQL插入各種性能優化

MySQL批量SQL插入性能優化詳解

mysql批量插入500條數據

mybatis mysql 批量插入

Mysql批量插入返回Id錯亂（原因分析）

mysql存儲過程批量向表插入數據

Mysql 批量插入 事務插入 效能對比

相關推薦

Mysql 批量插入事務插入效能對比