摘要:前言最近開發的項目因為需要用戶文本的存儲,自然就遇到了等表情符號如何被支持的問題。問題描述如果字符集且是服務器的話,當存儲含有表情時,會拋出類似如下異常這就是字符集不支持的異常。升級步驟的最低版本支持版本為,若不是,請升級到較新版本。
?
前言:最近開發的iOS項目因為需要用戶文本的存儲,自然就遇到了emoji等表情符號如何被mysql DB支持的問題。困擾了數日,在就要絕望放棄的邊緣,終于完成了轉換和遷移。在此特別分析和整理,方便更多人。
?
問題描述:如果UTF8字符集且是Java服務器的話,當存儲含有emoji表情時,會拋出類似如下異常:
java.sql.SQLException: Incorrect string value: "xF0x9Fx92x94" for column "name" at row 1 ? ? ? at com.mysql.jdbc.SQLError.createSQLException(SQLError.java:1073) ? ? ? at com.mysql.jdbc.MysqlIO.checkErrorPacket(MysqlIO.java:3593) ? ? ? at com.mysql.jdbc.MysqlIO.checkErrorPacket(MysqlIO.java:3525) ? ? ? at com.mysql.jdbc.MysqlIO.sendCommand(MysqlIO.java:1986) ? ? ? at com.mysql.jdbc.MysqlIO.sqlQueryDirect(MysqlIO.java:2140) ? ? ? at com.mysql.jdbc.ConnectionImpl.execSQL(ConnectionImpl.java:2620) ? ? ? at com.mysql.jdbc.StatementImpl.executeUpdate(StatementImpl.java:1662) ? ? ? at com.mysql.jdbc.StatementImpl.executeUpdate(StatementImpl.java:1581)
這就是字符集不支持的異常。因為UTF-8編碼有可能是兩個、三個、四個字節,其中Emoji表情是4個字節,而Mysql的utf8編碼最多3個字節,所以導致了數據插不進去。
升級前需要考慮的問題:如果你的項目要進行移動產品的用戶文本的存儲,將你的DB字符集從UTF8/GBK等傳統字符集升級到utf8mb4將是勢在必行。你可以通過應用層面轉換emoji等特殊字符,以達到原DB的兼容,我認為可行,但是你可能走了彎路。
utf8mb4作為utf8的super set,完全向下兼容,所以不用擔心字符的兼容性問題。切換中需要顧慮的主要影響是mysql需要重新啟動(雖然mysql官方文檔說可以動態修改配置,但是經過數次測試,還是需要重啟才可生效),對于業務可用率的影響是需要考慮的大問題,這里就暫時不展開討論了。
升級步驟:1.utf8mb4的最低mysql版本支持版本為5.5.3+,若不是,請升級到較新版本。
mysql版本查看命令請看:查看mysql版本的四種方法;mysql安裝步驟請看:Linux中升級Mysql到Mysql最新版本的方法
2.修改database、table和column字符集。參考以下語句:
ALTER DATABASE database_name CHARACTER SET = utf8mb4 COLLATE = utf8mb4_unicode_ci;
ALTER TABLE table_name CONVERT TO CHARACTER SET utf8mb4 COLLATE utf8mb4_unicode_ci;
ALTER TABLE table_name CHANGE column_name VARCHAR(191) CHARACTER SET utf8mb4 COLLATE utf8mb4_unicode_ci;
3.修改mysql配置文件my.cnf(windows為my.ini)
my.cnf一般在etc/mysql/my.cnf位置。找到后請在以下三部分里添加如下內容:
[client]
default-character-set = utf8mb4
[mysql]
default-character-set = utf8mb4
[mysqld]
character-set-client-handshake = FALSE
character-set-server = utf8mb4
collation-server = utf8mb4_unicode_ci
init_connect="SET NAMES utf8mb4"
4.重啟 MySQL Server、檢查字符集
1.)重啟命令參考:/etc/init.d/mysql restart
2.)輸入命令:mysql,進入mysql命令行(如果提示沒權限,可以嘗試輸入mysql -uroot -p你的密碼)
3.)在mysql命令行中輸入:SHOW VARIABLES WHERE Variable_name LIKE "character_set_%" OR Variable_name LIKE "collation%";
檢查是否如下:
+--------------------------+--------------------+
| Variable_name? ? ? ? ? ? | Value? ? ? ? ? ? ? |
+--------------------------+--------------------+
| character_set_client? ? | utf8mb4? ? ? ? ? ? |
| character_set_connection | utf8mb4? ? ? ? ? ? |
| character_set_database? | utf8mb4? ? ? ? ? ? |
| character_set_filesystem | binary? ? ? ? ? ? |
| character_set_results? ? | utf8mb4? ? ? ? ? ? |
| character_set_server? ? | utf8mb4? ? ? ? ? ? |
| character_set_system? ? | utf8? ? ? ? ? ? ? |
| collation_connection? ? | utf8mb4_unicode_ci |
| collation_database? ? ? | utf8mb4_unicode_ci |
| collation_server? ? ? ? | utf8mb4_unicode_ci |
+--------------------------+--------------------+
rows in set (0.00 sec)
特別說明下:collation_connection/collation_database/collation_server如果是utf8mb4_general_ci,沒有關系。但必須保證character_set_client/character_set_connection/character_set_database/character_set_results/character_set_server為utf8mb4。關于這些字符集配置是干什么用的,有什么區別,請參考:深入Mysql字符集設置
5.如果你用的是java服務器,升級或確保你的mysql connector版本高于5.1.13,否則仍然無法使用utf8mb4
這是mysql官方release note,大家可以查看說明,并下載最新的mysql connector for java的jar包。
這里為大家提供一個:mysql-connector-java-5.1.31-bin.jar
同時記得修改pom配置哦~
6.檢查你服務端的db配置文件:
?
jdbc.driverClassName=com.mysql.jdbc.Driver
jdbc.url=jdbc:mysql://localhost:3306/database?useUnicode=true&characterEncoding=utf8&autoReconnect=true&rewriteBatchedStatements=TRUE
jdbc.username=root
jdbc.password=password
?
特別說明其中的jdbc.url配置:如果你已經升級好了mysql-connector,其中的characterEncoding=utf8可以被自動被識別為utf8mb4(當然也兼容原來的utf8),而autoReconnect配置我強烈建議配上,我之前就是忽略了這個屬性,導致因為緩存緣故,沒有讀取到DB最新配置,導致一直無法使用utf8mb4字符集,多么痛的領悟!!
?
推薦閱讀以下兩篇文章也推薦大家參考,這兩位作者也都非常仔細的整理了相關思路和文檔,同時歡迎關注我的博客http://www.ilikewhite.com:
MySQL亂碼問題以及utf8mb4字符集
Emoji表情符號兼容方案
文章版權歸作者所有,未經允許請勿轉載,若此文章存在違規行為,您可以聯系管理員刪除。
轉載請注明本文地址:http://specialneedsforspecialkids.com/yun/64131.html
摘要:本文將介紹一種開發常見的亂碼問題。前提摘要在學習的過程中,亂碼問題是經常遇到的,無論是頁面亂碼還是數據庫亂碼。本文將羅列筆者在開發過程中常常遇到幾種亂碼場景。菜鳥筆記下周不見不散 本文將介紹一種Java Web/Api 開發常見的亂碼問題。 前提摘要:在學習Java Web的過程中,亂碼問題是經常遇到的,無論是頁面亂碼還是數據庫亂碼。本文將羅列筆者在開發過程中常常遇到幾種亂碼場景。 一...
摘要:自己的練習項目中涉及保存微信的,之前一直正常使用,但是突然遇到一個之前沒有遇到的問題。經過調試發現錯誤如下經過仔細查看發現可以獲得的數據,但是無法保存到數據庫,查看用戶的微信發現在中使用了字符。上查找發現主要解決方案就是的編碼設置由轉為。 自己的練習項目中涉及保存微信的nickname,之前一直正常使用,但是突然遇到一個之前沒有遇到的問題。經過調試發現錯誤如下: Incorrect ...
閱讀 1342·2019-08-30 15:55
閱讀 1644·2019-08-26 10:21
閱讀 3436·2019-08-23 18:28
閱讀 3374·2019-08-23 15:38
閱讀 743·2019-08-23 15:24
閱讀 2134·2019-08-23 13:59
閱讀 773·2019-08-23 11:31
閱讀 2869·2019-08-23 10:53