UTF8轉(zhuǎn)成GB2312亂碼問題解決方案
來源:易賢網(wǎng) 閱讀:889 次 日期:2014-08-10 17:17:35
溫馨提示:易賢網(wǎng)小編為您整理了“UTF8轉(zhuǎn)成GB2312亂碼問題解決方案”,方便廣大網(wǎng)友查閱!

最近做了一個小項目,遇到此類問題,記錄一下,也算是一個總結(jié)。

此項目分為兩部分,一個是新聞數(shù)據(jù)采集,一個是采集信息的審核,最后生成XML文件。

數(shù)據(jù)采集后的數(shù)據(jù)經(jīng)過用戶編輯完之后,要導(dǎo)出一個ACCESS文件,然后把這個文件導(dǎo)入到信息審核系統(tǒng)。在ACCESS庫中存儲新聞信息的字段類型是ntext類型,而審核系統(tǒng)庫中對應(yīng)的是varchar(max)類型的字段,導(dǎo)入之后,發(fā)現(xiàn)有的空白字符會出現(xiàn)亂碼,表現(xiàn)為問號(?),其實經(jīng)過后面的測試,這不是空白(空格)字符,而一個特殊字符,怎么辦?經(jīng)過幾番測試后發(fā)現(xiàn),varchar(max)類型要改成nvarchar(max)類型,這樣導(dǎo)入的數(shù)據(jù)就不會再有此類問題了。

但后面的測試過程中,又會發(fā)現(xiàn)對導(dǎo)入后的采集信息更改(通過.net程序編輯功能)后,數(shù)據(jù)庫中此條信息又出現(xiàn)了亂碼問題,研究后發(fā)現(xiàn)在插入語句中這樣寫就不會出現(xiàn)此類問題了,如insert into 表名 (news)values(N'"+更新后的值+""),為什么加N?去百度一下就明白了。

到此,心中總算得到安慰,但后面的問題又讓人陷入郁悶之中。。。。。。

審核完的信息要生成XML類型的文件,并且XML要采用GB2312編碼,因為采集的新聞網(wǎng)站,有很多網(wǎng)站采用的是UTF8編碼,這樣在轉(zhuǎn)化的過程中又出現(xiàn)亂碼(還是那個“空白”特殊字符搞的),怎么辦?網(wǎng)上介紹的把UTF8轉(zhuǎn)化成GB2312就可以了,但實際發(fā)現(xiàn),還是解決不了問題,這下弄的一上午為了解決這個問題,最后還是沒有辦法,正郁悶之時,突然想到通過VS的調(diào)試功能來看看這個特殊字符究竟是什么玩意,最后通過把數(shù)據(jù)庫的此字段值讀取出來之后,然后轉(zhuǎn)化成字符數(shù)組,content.ToCharArray(); 一個一個的看,發(fā)現(xiàn),導(dǎo)致亂碼的這個字符是' '注意引號中的空白,這不是一個空格,而是一個在GB2312中無法識別的特殊字符,此時突然想到,能不能把這個字符的值直接用空格替換呢?馬上行動,果然,解決了亂碼問題。真求郁悶,這一個毛玩意浪費了一半天時間。

注意,必須要用調(diào)試出來的這個值(因為這才是真正的導(dǎo)致亂碼的那個特殊字符),調(diào)試的時候在即使窗體中粘貼。

代碼如下:

content = content.Replace(" ", " ");

更多信息請查看IT技術(shù)專欄

更多信息請查看網(wǎng)絡(luò)編程
易賢網(wǎng)手機網(wǎng)站地址:UTF8轉(zhuǎn)成GB2312亂碼問題解決方案
由于各方面情況的不斷調(diào)整與變化,易賢網(wǎng)提供的所有考試信息和咨詢回復(fù)僅供參考,敬請考生以權(quán)威部門公布的正式信息和咨詢?yōu)闇?zhǔn)!

2025國考·省考課程試聽報名

  • 報班類型
  • 姓名
  • 手機號
  • 驗證碼
關(guān)于我們 | 聯(lián)系我們 | 人才招聘 | 網(wǎng)站聲明 | 網(wǎng)站幫助 | 非正式的簡要咨詢 | 簡要咨詢須知 | 加入群交流 | 手機站點 | 投訴建議
工業(yè)和信息化部備案號:滇ICP備2023014141號-1 云南省教育廳備案號:云教ICP備0901021 滇公網(wǎng)安備53010202001879號 人力資源服務(wù)許可證:(云)人服證字(2023)第0102001523號
云南網(wǎng)警備案專用圖標(biāo)
聯(lián)系電話:0871-65099533/13759567129 獲取招聘考試信息及咨詢關(guān)注公眾號:hfpxwx
咨詢QQ:526150442(9:00—18:00)版權(quán)所有:易賢網(wǎng)
云南網(wǎng)警報警專用圖標(biāo)