微信公众号搜"智元新知"关注
微信扫一扫可直接关注哦!

MySQL中不能使用UTF-8编码方式的原因

下面一起来了解下MySQL中不能使用UTF-8编码方式的原因,相信大家看完肯定会受益匪浅,文字在精不在多,希望MysqL中不能使用UTF-8编码方式的原因这篇短内容是你想要的。                                                          

MySQL中不能使用UTF-8编码方式的原因

MysqL的UTF-8编码方式

MysqL 从 4.1 版本开始支持 UTF-8,也就是 2003 年,然而目前流行的UTF-8 标准(RFC 3629)是在此之后规定的。正因此,才造就了MysqL中的UTF-8与我们日常开发中的UTF-8不一致,从到导致了些问题。MysqL的UTF-8只支持每个字符最多三个字节,而真正的 UTF-8 是每个字符最多四个字节。

问题复现

数据库表如下:utf8编码方式

MySQL中不能使用UTF-8编码方式的原因

数据库存一条记录:

@Test public void testInsert() {     User user = new User();     user.setUsername("\uD83D\uDE00 ");     user.setPassword("123456");     userRepo.save(user); }

这里只是部分代码,看不懂没关系,这里是给user表插入一条记录。其中username是\uD83D\uDE00 。

其实\uD83D\uDE00是一个emoji表情。

MySQL中不能使用UTF-8编码方式的原因

因为MysqL中utf8字符集只支持三字节UTF-8编码的Unicode范围,而emoji字符属于四字节编码部分,所以程序运行预期是会报错的。运行这段代码

MySQL中不能使用UTF-8编码方式的原因

与预期一致,报错了。

解决问题

虽然MysqL的UTF-8存在缺陷,但是MysqL包括mariadb)官方却没有修复此bug,而是通过2010年重新发布的“utf8mb4”来支持真正的 UTF-8。因此想要解决此问题,只能够将MysqL数据库设置为utf8mb4字符集才行。

总结

这个问题,也是因为某次保存数据的时候保存了一个emoji表情才发现的。其实最早开始用MysqL的时候,就有发现一个utf8mb4了,但是自己却没有却去了解UTF8和UTF8MB4的区别。通过此次教训,以后使用MysqL就老老实实的设置字符集为utf8mb4吧。

看完MysqL中不能使用UTF-8编码方式的原因这篇文章后,很多读者朋友肯定会想要了解更多的相关内容,如需获取更多的行业信息,可以关注我们的行业资讯栏目。

版权声明:本文内容由互联网用户自发贡献,该文观点与技术仅代表作者本人。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。如发现本站有涉嫌侵权/违法违规的内容, 请发送邮件至 dio@foxmail.com 举报,一经查实,本站将立刻删除。

相关推荐