中文字元轉碼

2021-11-13 11:48:49

php 提供了兩個常用的轉碼函數

<b>iconv</b> ( string $in_charset , string $out_charset , string $str ) 和

<b>mb_convert_encoding</b> ( string $str , string $to_encoding [, $from_encoding ] )（需要enable mbstring 擴充）

具體使用可以參考手冊，我這裡要說的是在使用mb_convert_encoding時可以配合mb_detect_encoding函數“探測”輸入字元編碼，代碼如下

同時在使用mb_conver_encoding應注意一下情況：

PHP中使用mb_convert_encoding轉碼的小陷阱

在php程式中使用mb_convert_encoding()方法進行字元編碼轉換大家都很熟悉了，平時也在大量的使用。而且在一般情況下該方法也表現的足夠好，值得表揚。但在一個項目中我們需要使用它進行UTF8到GBK的轉換，在轉換一些特殊字元時發現了一個不大不小的問題。具體表現為mb把在 utf8可編碼的字元而在gbk中不可編碼的字元都轉成了\0x00\0x80,這樣就導緻轉換後的gbk字元是有問題的。

在我們的意識中，在進行字元編碼轉換的過程中，如果遇到目标編碼不可表現的字元，轉碼程式應該做的是舍棄這種字元，這樣雖然丢失了部分資料，但不會導緻轉碼的字元序列不可用。不清楚mb為什麼要使用上述方式而不是舍棄方式。

臨時的解決方式是對轉碼後的字元串序列進行過濾，過濾掉所有\x00\80的字元；又或者在轉義之前對utf8的字元串進行過濾，過濾掉ut8可表示而gbk不可表示的所有字元，從實作難度上來講，第一種過濾方式比較容易做到。

中文字元轉碼

繼續閱讀

第三章 Joomla!擴充開發--後端開發（續2）

Centos 7 Apache配置虛拟主機

PHP進階學習之session寫入資料庫

php寫一個簡潔的登入頁面

Apache與PHP環境下配置本地虛拟主機

Testlink安裝部署之XAMPP

TestLink 圖表中文亂碼問題

ecshop屬性排序

Ubuntu16.04安裝Apache+MySQL+PHP1. 安裝Apache2. 安裝MySQL3. 安裝PHP4. 安裝phpMyAdmin

版本号隐藏

Apache配置SSLApache配置SSL

配置apache支援PHP（win7）

Cloud Studio初體驗

NOSQL安全攻擊

php 去掉字元串的最後一個字元及截取原字元串1,2,3,4,5,6,

php——水印