MySQL批量插入遇上唯一索引避免方法_mysql数据库教程-查字典教程网

MySQL批量插入遇上唯一索引避免方法

摘要：一、背景以前使用SQLServer进行表分区的时候就碰到很多关于唯一索引的问题：Step8：SQLServer当表分区遇上唯一约束，没想到在...

一、背景

以前使用SQL Server进行表分区的时候就碰到很多关于唯一索引的问题：Step8：SQL Server 当表分区遇上唯一约束，没想到在MySQL的分区中一样会遇到这样的问题：MySQL表分区实战。

今天我们来了解MySQL唯一索引的一些知识：包括如何创建，如何批量插入，还有一些技巧上SQL；

这些问题的根源在什么地方？有什么共同点？MySQL中也有分区对齐的概念？唯一索引是在很多系统中都会出现的要求，有什么办法可以避免？它对性能的影响有多大？

二、过程

(一) 导入差异数据，忽略重复数据，IGNORE INTO的使用

在MySQL创建表的时候，我们通常创建一个表的时候是以一个自增ID值作为主键，那么MySQL就会以PRIMARY KEY作为聚集索引键和主键，既然是主键，那当然是唯一的了，所以重复执行下面的插入语句会报1062错误：如Figure1所示；

复制代码代码如下:

-- 创建测试表

CREATE TABLE `testtable` (

`Id` INT(11) UNSIGNED NOT NULL AUTO_INCREMENT,

`UserId` INT(11) DEFAULT NULL,

`UserName` VARCHAR(10) DEFAULT NULL,

`UserType` INT(11) DEFAULT NULL,

PRIMARY KEY (`Id`)

) ENGINE=INNODB DEFAULT CHARSET=utf8;

-- 插入测试数据

INSERT INTO testtable(Id,UserId,UserName,UserType)

VALUES(1,101,'aa',1),(2,102,'bbb',2),(3,103,'ccc',3);

MySQL批量插入遇上唯一索引避免方法1

（Figure1：Duplicate entry '1' for key 'PRIMARY'）

但是在实际的生产环境中，需求往往是需要在UserId键值中设置唯一索引，今天我就以这个作为示例，进行唯一索引的测试：

复制代码代码如下:

-- 创建测试表1

CREATE TABLE `testtable1` (

`Id` INT(11) UNSIGNED NOT NULL AUTO_INCREMENT,

`UserId` INT(11) DEFAULT NULL,

`UserName` VARCHAR(10) DEFAULT NULL,

`UserType` INT(11) DEFAULT NULL,

PRIMARY KEY (`Id`),

UNIQUE KEY `IX_UserId` (`UserId`)

) ENGINE=INNODB DEFAULT CHARSET=utf8;

-- 创建测试表2

CREATE TABLE `testtable2` (

`Id` INT(11) UNSIGNED NOT NULL AUTO_INCREMENT,

`UserId` INT(11) DEFAULT NULL,

`UserName` VARCHAR(10) DEFAULT NULL,

`UserType` INT(11) DEFAULT NULL,

PRIMARY KEY (`Id`),

UNIQUE KEY `IX_UserId` (`UserId`)

) ENGINE=INNODB DEFAULT CHARSET=utf8;

-- 插入测试数据1

INSERT INTO testtable1(Id,UserId,UserName,UserType)

VALUES(1,101,'aa',1),(2,102,'bbb',2),(3,103,'ccc',3);

-- 插入测试数据2

INSERT INTO testtable2(Id,UserId,UserName,UserType)

VALUES(1,201,'aaa',1),(2,202,'bbb',2),(3,203,'ccc',3),(4,101,'xxxx',5);

MySQL批量插入遇上唯一索引避免方法2

（Figure2：testtable1记录）

MySQL批量插入遇上唯一索引避免方法3

（Figure3：testtable2记录）

通过执行上面的SQL脚本，我们在testtable1和testtable2都创建了唯一索引：UNIQUE KEY `IX_UserId` (`UserId`)，这就说明UserId在testtable1和testtable2表中都是唯一的，如果把testtable2的数据批量导入到testtable1，如果执行下面【导入1】的SQL，就会出现1062的错误，导致整个过程会回滚，没有达到导入差异数据的目的。

复制代码代码如下:

INSERT INTO testtable1(UserId,UserName,UserType)

SELECT UserId,UserName,UserType FROM testtable2;

MySQL批量插入遇上唯一索引避免方法4

（Figure4：Duplicate entry '101' for key 'IX_UserId'）

MySQL提供一个关键字：IGNORE，这个关键字判断每条记录是否存在，是否违反饿了表中的唯一索引，如果存在就不插入，而不存在的记录就会插入。

复制代码代码如下:

-- 导入2

INSERT IGNORE INTO testtable1(UserId,UserName,UserType)

SELECT UserId,UserName,UserType FROM testtable2;

所以执行完【导入2】，就会产生Figure5的结果，这已经达到了我们的目的了，但是你有没发现自增的ID值跳过了一些值，这是因为我们之前执行【导入1】失败造成的，虽然我们的事务回滚了，但是自增ID会出现断层。在SQL Server中也会有这样的问题。扩展阅读：简单实用SQL脚本Part：查找SQL Server 自增ID值不连续记录

MySQL批量插入遇上唯一索引避免方法5