最近开发的iOS项目由于须要用户文本的存储,天然就遇到了emoji等表情符号如何被MySQL DB支持的问题。困扰了很多天,在就要绝望放弃的边缘,终于完成了转换和迁移。在此特别分析和整理,方便更多人。html
若是UTF8字符集且是Java服务器的话,当存储含有emoji表情时,会抛出相似以下异常:java
java.sql.SQLException: Incorrect string value: '\xF0\x9F\x92\x94' for column 'name' at row 1
at com.mysql.jdbc.SQLError.createSQLException(SQLError.java:1073)
at com.mysql.jdbc.MysqlIO.checkErrorPacket(MysqlIO.java:3593)
at com.mysql.jdbc.MysqlIO.checkErrorPacket(MysqlIO.java:3525)
at com.mysql.jdbc.MysqlIO.sendCommand(MysqlIO.java:1986)
at com.mysql.jdbc.MysqlIO.sqlQueryDirect(MysqlIO.java:2140)
at com.mysql.jdbc.ConnectionImpl.execSQL(ConnectionImpl.java:2620)
at com.mysql.jdbc.StatementImpl.executeUpdate(StatementImpl.java:1662)
at com.mysql.jdbc.StatementImpl.executeUpdate(StatementImpl.java:1581)
这就是字符集不支持的异常。由于UTF-8编码有多是两个、三个、四个字节,其中Emoji表情是4个字节,而MySQL的utf8编码最多3个字节,因此致使了数据插不进去。mysql
若是你的项目要进行移动产品的用户文本的存储,将你的DB字符集从utf8/gbk等传统字符集升级到utf8mb4将是势在必行。你能够经过应用层面转换emoji等特殊字符,以达到原DB的兼容,我认为可行,可是你可能走了弯路。linux
utf8mb4做为utf8的super set,彻底向下兼容,因此不用担忧字符的兼容性问题。切换中须要顾虑的主要影响是MySQL须要从新启动(虽然MySQL官方文档说能够动态修改配置,可是通过数次测试,仍是须要重启才可生效),对于业务可用率的影响是须要考虑的大问题,这里就暂时不展开讨论了。sql
1.utf8mb4的最低MySQL版本支持版本为5.5.3+,若不是,请升级到较新版本。segmentfault
MySQL版本查看命令请看:查看mysql版本的四种方法;MySQL安装步骤请看:Linux中升级Mysql到Mysql最新版本的方法
2.修改database、table和column字符集。参考如下语句:
ALTER DATABASE database_name CHARACTER SET = utf8mb4 COLLATE = utf8mb4_unicode_ci;
ALTER TABLE table_name CONVERT TO CHARACTER SET utf8mb4 COLLATE utf8mb4_unicode_ci;
ALTER TABLE table_name CHANGE column_name VARCHAR(191) CHARACTER SET utf8mb4 COLLATE utf8mb4_unicode_ci;
3.修改mysql配置文件my.cnf(windows为my.ini)windows
my.cnf通常在etc/mysql/my.cnf位置。找到后请在如下三部分里添加以下内容:缓存
[client] default-character-set = utf8mb4服务器
[mysql] default-character-set = utf8mb4测试
[mysqld]
character-set-client-handshake = FALSE
character-set-server = utf8mb4
collation-server = utf8mb4_unicode_ci
init_connect='SET NAMES utf8mb4'
4.重启 MySQL Server、检查字符集
1.)重启命令参考:/etc/init.d/mysql restart
2.)输入命令:mysql,进入mysql命令行(若是提示没权限,能够尝试输入mysql -uroot -p你的密码)
3.)在mysql命令行中输入:SHOW VARIABLES WHERE Variable_name LIKE 'character_set_%' OR Variable_name LIKE 'collation%';
检查是否以下:
+--------------------------+--------------------+
| Variable_name | Value |
+--------------------------+--------------------+
| character_set_client | utf8mb4 |
| character_set_connection | utf8mb4 |
| character_set_database | utf8mb4 |
| character_set_filesystem | binary |
| character_set_results | utf8mb4 |
| character_set_server | utf8mb4 |
| character_set_system | utf8 |
| collation_connection | utf8mb4_unicode_ci |
| collation_database | utf8mb4_unicode_ci |
| collation_server | utf8mb4_unicode_ci |
+--------------------------+--------------------+
rows in set (0.00 sec)
特别说明下:collation_connection/collation_database/collation_server若是是utf8mb4_general_ci,没有关系。但必须保证character_set_client/character_set_connection/character_set_database/character_set_results/character_set_server为utf8mb4。关于这些字符集配置是干什么用的,有什么区别,请参考:深刻Mysql字符集设置
5.若是你用的是java服务器,升级或确保你的mysql connector版本高于5.1.13,不然仍然没法使用utf8mb4
这是mysql官方release note,你们能够查看说明,并下载最新的mysql connector for java的jar包。
这里为你们提供一个:mysql-connector-java-5.1.31-bin.jar
同时记得修改pom配置哦~
6.检查你服务端的DB配置文件:
jdbc.driverClassName=com.mysql.jdbc.Driver
jdbc.url=jdbc:mysql://localhost:3306/database?useUnicode=true&characterEncoding=utf8&autoReconnect=true&rewriteBatchedStatements=TRUE
jdbc.username=root
jdbc.password=password
特别说明其中的jdbc.url配置:若是你已经升级好了mysql-connector,其中的characterEncoding=utf8能够被自动被识别为utf8mb4(固然也兼容原来的utf8),而autoReconnect配置我强烈建议配上,我以前就是忽略了这个属性,致使由于缓存缘故,没有读取到DB最新配置,致使一直没法使用utf8mb4字符集,多么痛的领悟!!