将mysql表从latin1转换为utf8

Bre*_*ley 16 mysql collation utf-8 latin1 mysql-error-1062

我正在尝试将一些mysql表从latin1转换为utf8.我正在使用以下命令,这似乎主要起作用.

ALTER TABLE tablename CONVERT TO CHARACTER SET utf8 COLLATE utf8_general_ci;
Run Code Online (Sandbox Code Playgroud)

但是,在一个表上,我收到有关重复键输入的错误.这是由"名称"字段上的唯一索引引起的.在转换为utf8时,似乎任何"特殊"字符都被索引为它们的直接英语等价物.例如,已存在名称字段值为"Dru"的记录.转换为utf8时,带有"Drü"的记录被视为重复记录.与"Patrick"和"Påtrìçk"相同.

以下是如何重现该问题:

CREATE TABLE `example` (   `name` char(20) CHARACTER SET latin1 NOT NULL,
  PRIMARY KEY (`name`) ) ENGINE=MyISAM DEFAULT CHARSET=latin1;

INSERT INTO example (name) VALUES ('Drü'),('Dru'),('Patrick'),('Påtrìçk');

ALTER TABLE example convert to character set utf8 collate utf8_general_ci;
ERROR 1062 (23000): Duplicate entry 'Dru' for key 1
Run Code Online (Sandbox Code Playgroud)

Ham*_*ite 20

字符串'Drü''Dru'评价相同的原因是在utf8_general_ci整理中,它们被视为"相同".字符集的排序规则的目的是提供一组关于字符串何时相同,何时排序在另一个之前的规则,依此类推.

如果需要一组不同的比较规则,则需要选择其他排序规则.您可以utf8通过发布查看字符集的可用排序规则SHOW COLLATION LIKE 'utf8%'.有许多用于文本的排序规则,主要是特定语言; 还有一个utf8_bin校对,它将所有字符串作为二进制字符串进行比较(即将它们作为0和1的序列进行比较).