溫馨提示×

溫馨提示×

您好,登錄后才能下訂單哦!

密碼登錄×
登錄注冊×
其他方式登錄
點擊 登錄注冊 即表示同意《億速云用戶服務條款》

【XML】UTF8和GB2312編碼轉換出現(xiàn)亂碼怎么辦

發(fā)布時間:2020-10-10 16:32:34 來源:億速云 閱讀:269 作者:小新 欄目:編程語言

【XML】UTF8和GB2312編碼轉換出現(xiàn)亂碼怎么辦?這個問題可能是我們日常學習或工作經常見到的。希望通過這個問題能讓你收獲頗深。下面是小編給大家?guī)淼膮⒖純热?,讓我們一起來看看吧?/p>

審核完的信息要生成XML類型的文件,并且XML要采用GB2312編碼,因為采集的新聞網(wǎng)站,有很多網(wǎng)站采用的是UTF8編碼,這樣在轉化的過程中又出現(xiàn)亂碼

最近做了一個小項目,遇到此類問題,記錄一下,也算是一個總結。
此項目分為兩部分,一個是新聞數(shù)據(jù)采集,一個是采集信息的審核,最后生成XML文件。
數(shù)據(jù)采集后的數(shù)據(jù)經過用戶編輯完之后,要導出一個ACCESS文件,然后把這個文件導入到信息審核系統(tǒng)。在ACCESS庫中存儲新聞信息的字段類型是ntext類型,而審核系統(tǒng)庫中對應的是varchar(max)類型的字段,導入之后,發(fā)現(xiàn)有的空白字符會出現(xiàn)亂碼,表現(xiàn)為問號(?),其實經過后面的測試,這不是空白(空格)字符,而一個特殊字符,怎么辦?經過幾番測試后發(fā)現(xiàn),varchar(max)類型要改成nvarchar(max)類型,這樣導入的數(shù)據(jù)就不會再有此類問題了。
但后面的測試過程中,又會發(fā)現(xiàn)對導入后的采集信息更改(通過.net程序編輯功能)后,數(shù)據(jù)庫中此條信息又出現(xiàn)了亂碼問題,研究后發(fā)現(xiàn)在插入語句中這樣寫就不會出現(xiàn)此類問題了,如insert into 表名 (news)values(N'"+更新后的值+""),為什么加N?去百度一下就明白了。
到此,心中總算得到安慰,但后面的問題又讓人陷入郁悶之中。。。。。。
審核完的信息要生成XML類型的文件,并且XML要采用GB2312編碼,因為采集的新聞網(wǎng)站,有很多網(wǎng)站采用的是UTF8編碼,這樣在轉化的過程中又出現(xiàn)亂碼(還是那個“空白”特殊字符搞的),怎么辦?網(wǎng)上介紹的把UTF8轉化成GB2312就可以了,但實際發(fā)現(xiàn),還是解決不了問題,這下弄的一上午為了解決這個問題,最后還是沒有辦法,正郁悶之時,突然想到通過VS的調試功能來看看這個特殊字符究竟是什么玩意,最后通過把數(shù)據(jù)庫的此字段值讀取出來之后,然后轉化成字符數(shù)組,content.ToCharArray(); 一個一個的看,發(fā)現(xiàn),導致亂碼的這個字符是' '注意引號中的空白,這不是一個空格,而是一個在GB2312中無法識別的特殊字符,此時突然想到,能不能把這個字符的值直接用空格替換呢?馬上行動,果然,解決了亂碼問題。真求郁悶,這一個毛玩意浪費了一半天時間。
注意,必須要用調試出來的這個值(因為這才是真正的導致亂碼的那個特殊字符),調試的時候在即使窗體中粘貼。

代碼如下:

content = content.Replace(" ", " ");

感謝各位的閱讀!看完上述內容,你們對【XML】UTF8和GB2312編碼轉換出現(xiàn)亂碼怎么辦大概了解了嗎?希望文章內容對大家有所幫助。如果想了解更多相關文章內容,歡迎關注億速云行業(yè)資訊頻道。

向AI問一下細節(jié)

免責聲明:本站發(fā)布的內容(圖片、視頻和文字)以原創(chuàng)、轉載和分享為主,文章觀點不代表本網(wǎng)站立場,如果涉及侵權請聯(lián)系站長郵箱:is@yisu.com進行舉報,并提供相關證據(jù),一經查實,將立刻刪除涉嫌侵權內容。

xml
AI