mysql编码utf8和utf8mb4的区别以及 Mysql导入数据的时候报错： Unknown collation: ‘utf8mb4_0900_ai_ci‘ 的解决办法

一、简介

MySQL在5.5.3之后增加了这个utf8mb4的编码，mb4就是most bytes 4的意思，专门用来兼容四字节的unicode。utf8mb4是utf8的超集，除了将编码改为utf8mb4外不需要做其他转换。当然，为了节省空间，一般情况下使用utf8也就够了。

二、内容描述

那上面说了既然utf8能够存下大部分中文汉字,那为什么还要使用utf8mb4呢? 原来mysql支持的 utf8 编码最大字符长度为 3 字节，如果遇到 4 字节的宽字符就会插入异常了。三个字节的 UTF-8 最大能编码的 Unicode 字符是 0xffff，也就是 Unicode 中的基本多文种平面(BMP)。也就是说，任何不在基本多文本平面的 Unicode字符，都无法使用 Mysql 的 utf8 字符集存储。包括 Emoji 表情(Emoji 是一种特殊的 Unicode 编码，常见于 ios 和 android 手机上)，和很多不常用的汉字，以及任何新增的 Unicode 字符等等(utf8的缺点)。

通常，计算机在存储字符时，会根据不同类型的字符以及编码方式分配存储空间。例如以下几种编码方式;

①ASCII编码中，一个英文字母（不分大小写）占用一个字节的空间，一个中文汉字占用两个字节的空间。一个二进制的数字序列，在计算机中作为一个数字单元存储时，一般为8位二进制数，换算为十进制。最小值0，最大值255。

②UTF-8编码中，一个英文字符占用一个字节的存储空间，一个中文（含繁体）占用三个字节的存储空间。

③Unicode编码中，一个英文占用两个字节的存储空间，一个中文（含繁体）占用两个字节的存储空间。

④UTF-16编码中，一个英文字母字符或一个汉字字符存储都需要占用2个字节的存储空间（Unicode扩展区的一些汉字存储需要4个字节）。

⑤UTF-32编码中，世界上任何字符的存储都需要占用4个字节的存储空间。

既然utf8能兼容绝大部分的字符，为什么要扩展utf8mb4？

随着互联网的发展，产生了许多新类型的字符，例如emoji这种类型的符号，也就是我们通常在聊天时发的小黄脸表情，这种字符的出现不在基本多平面的Unicode字符之中，导致无法在MySQL中使用utf8存储，MySQL于是对utf8字符进行了扩展，增加了utf8mb4这个编码。

所以，设计数据库时如果想要允许用户使用特殊符号，最好使用utf8mb4编码来存储，使得数据库有更好的兼容性，但是这样设计会导致耗费更多的存储空间。

【飙歌实战】

Mysql导入数据的时候报错： Unknown collation: 'utf8mb4_0900_ai_ci'
最近从线上把数据导出来想搭建到本地的时候报了这么一个错？
[ERR] 1273 - Unknown collation: 'utf8mb4_0900_ai_ci'
这个错误究竟是什么原因影响的呢？

是因为我们导出数据的那个数据库版本为8.0，而我们导入的数据库版本为5.6
因为是高版本导入到低版本，所以引起1273错误。
也就是a数据库为8.0的版本，而b数据库为5.6的版本，我们把a数据库的数据导出来后想要直接导入导b里面所以报了这个错误

解决方法1：
打开sql文件，将文件中的所有 utf8mb4_0900_ai_ci 替换为 utf8_general_ci
utf8mb4 替换为 utf8mb3 或 utf8

保存后再次运行sql文件，将会成功!

解决方法2：

导出表结构保存sql，把表结构的sql文件中的所有 utf8mb4_0900_ai_ci 替换为 utf8_general_ci
utf8mb4 替换为 utf8mb3 或 utf8 保存sql，新建一个库，导入这个表结构，用Navicat工具同步表结构到mysql8.0上的目标数据库。同步完成后再次导出的sql文件，就可以兼容本机5.6版本数据库了！

mysql编码utf8和utf8mb4的区别 以及 Mysql导入数据的时候报错： Unknown collation: ‘utf8mb4_0900_ai_ci‘ 的解决办法

猜你喜欢

mysql编码utf8和utf8mb4的区别以及 Mysql导入数据的时候报错： Unknown collation: ‘utf8mb4_0900_ai_ci‘ 的解决办法