emoji等表情符号存mysql的方法
项目中需要存储用户信息(用户昵称有表情符号),自然就遇到了emoji等表情符号如何被mysql db支持的问题
这里引用先行者博文:https://segmentfault.com/a/1190000000616820
如果utf8字符集且是java服务器的话,当存储含有emoji表情时,会抛出类似如下异常:
java.sql.sqlexception: incorrect string value: '\xf0\x9f\x92\x94' for column 'name' at row 1 at com.mysql.jdbc.sqlerror.createsqlexception(sqlerror.java:1073) at com.mysql.jdbc.mysqlio.checkerrorpacket(mysqlio.java:3593) at com.mysql.jdbc.mysqlio.checkerrorpacket(mysqlio.java:3525) at com.mysql.jdbc.mysqlio.sendcommand(mysqlio.java:1986) at com.mysql.jdbc.mysqlio.sqlquerydirect(mysqlio.java:2140) at com.mysql.jdbc.connectionimpl.execsql(connectionimpl.java:2620) at com.mysql.jdbc.statementimpl.executeupdate(statementimpl.java:1662) at com.mysql.jdbc.statementimpl.executeupdate(statementimpl.java:1581)
这就是字符集不支持的异常。因为utf-8编码有可能是两个、三个、四个字节,其中emoji表情是4个字节,而mysql的utf8编码最多3个字节,所以导致了数据插不进去。
升级前需要考虑的问题:
如果你的项目要进行移动产品的用户文本的存储,将你的db字符集从utf8/gbk等传统字符集升级到utf8mb4将是势在必行。你可以通过应用层面转换emoji等特殊字符,以达到原db的兼容,我认为可行,但是你可能走了弯路。
utf8mb4作为utf8的super set,完全向下兼容,所以不用担心字符的兼容性问题。切换中需要顾虑的主要影响是mysql需要重新启动(虽然mysql官方文档说可以动态修改配置,但是经过数次测试,还是需要重启才可生效),对于业务可用率的影响是需要考虑的大问题,这里就暂时不展开讨论了。
升级步骤:
1.utf8mb4的最低mysql版本支持版本为5.5.3+,若不是,请升级到较新版本。
mysql版本查看命令请看:;mysql安装步骤请看:linux中升级mysql到mysql最新版本的方法
2.修改database、table和column字符集。参考以下语句:
alter database database_name character set = utf8mb4 collate = utf8mb4_unicode_ci;
alter table table_name convert to character set utf8mb4 collate utf8mb4_unicode_ci;
alter table table_name change column_name varchar(191) character set utf8mb4 collate utf8mb4_unicode_ci;
3.修改mysql配置文件my.cnf(windows为my.ini)
my.cnf一般在etc/mysql/my.cnf位置。找到后请在以下三部分里添加如下内容:
[client]
default-character-set = utf8mb4
[mysql]
default-character-set = utf8mb4
[mysqld]
character-set-client-handshake = false
character-set-server = utf8mb4
collation-server = utf8mb4_unicode_ci
init_connect='set names utf8mb4'
4.重启 mysql server、检查字符集
1.)重启命令参考:/etc/init.d/mysql restart
2.)输入命令:mysql,进入mysql命令行(如果提示没权限,可以尝试输入mysql -uroot -p你的密码)
3.)在mysql命令行中输入:show variables where variable_name like 'character_set_%' or variable_name like 'collation%';
检查是否如下:
+--------------------------+--------------------+
| variable_name | value |
+--------------------------+--------------------+
| character_set_client | utf8mb4 |
| character_set_connection | utf8mb4 |
| character_set_database | utf8mb4 |
| character_set_filesystem | binary |
| character_set_results | utf8mb4 |
| character_set_server | utf8mb4 |
| character_set_system | utf8 |
| collation_connection | utf8mb4_unicode_ci |
| collation_database | utf8mb4_unicode_ci |
| collation_server | utf8mb4_unicode_ci |
+--------------------------+--------------------+
rows in set (0.00 sec)
特别说明下:collation_connection/collation_database/collation_server如果是utf8mb4_general_ci,没有关系。但必须保证character_set_client/character_set_connection/character_set_database/character_set_results/character_set_server为utf8mb4。关于这些字符集配置是干什么用的,有什么区别,请参考:深入mysql字符集设置
5.如果你用的是java服务器,升级或确保你的mysql connector版本高于5.1.13,否则仍然无法使用utf8mb4
这是mysql官方,大家可以查看说明,并下载最新的mysql connector for java的jar包。
这里为大家提供一个:
同时记得修改pom配置哦~
6.检查你服务端的db配置文件:
jdbc.driverclassname=com.mysql.jdbc.driver
jdbc.url=jdbc:mysql://localhost:3306/database?useunicode=true&characterencoding=utf8&autoreconnect=true&rewritebatchedstatements=true
jdbc.username=root
jdbc.password=password
特别说明其中的jdbc.url配置:如果你已经升级好了mysql-connector,其中的characterencoding=utf8可以被自动被识别为utf8mb4(当然也兼容原来的utf8),而autoreconnect配置我强烈建议配上,我之前就是忽略了这个属性,导致因为缓存缘故,没有读取到db最新配置,导致一直无法使用utf8mb4字符集,多么痛的领悟!!
源地址:https://segmentfault.com/a/1190000000616820
上一篇: SpringBoot配置属性之DataSource
下一篇: 微信及QQ邮箱漂流瓶服务因色情内容暂停