您好,登錄后才能下訂單哦!
小編給大家分享一下python編碼和解碼有什么區(qū)別,希望大家閱讀完這篇文章后大所收獲,下面讓我們一起去探討吧!
python中的編碼與解碼的區(qū)別:
編碼 / encode:將 Unicode 字符串轉(zhuǎn)換為特定編碼格式對應(yīng)的字節(jié)碼的過程
解碼 / decode:將特定編碼格式的字節(jié)碼轉(zhuǎn)換為對應(yīng)的 Unicode 字符串的過程
示例:
In [43]: '美麗人生'.encode('gbk') Out[43]: b'\xc3\xc0\xc0\xf6\xc8\xcb\xc9\xfa' In [44]: b'\xc3\xc0\xc0\xf6\xc8\xcb\xc9\xfa'.decode('gbk') Out[44]: '美麗人生' In [45]: '美麗人生'.encode('utf-8') Out[45]: b'\xe7\xbe\x8e\xe4\xb8\xbd\xe4\xba\xba\xe7\x94\x9f' In [46]: b'\xe7\xbe\x8e\xe4\xb8\xbd\xe4\xba\xba\xe7\x94\x9f'.decode('utf-8') Out[46]: '美麗人生' In [47]: b'\xc3\xc0\xc0\xf6\xc8\xcb\xc9\xfa'.decode('gbk').encode('utf-8') Out[47]: b'\xe7\xbe\x8e\xe4\xb8\xbd\xe4\xba\xba\xe7\x94\x9f'
上面這種以 b 開頭的就是字節(jié)碼,一個(gè)斜杠就是一個(gè)字節(jié)??梢?,一個(gè)常用漢字用 GBK 格式編碼后占 2 個(gè)字節(jié),用 UTF-8 格式編碼后占 3 個(gè)字節(jié)。因?yàn)榇鎯?chǔ)或傳輸時(shí),也用 UTF-8 編碼,所以一個(gè)漢字占的空間就是 3 個(gè)字節(jié)。
字符串長度和字節(jié)碼長度:
In [61]: len('美麗人生') Out[61]: 4 In [62]: len(b'\xe7\xbe\x8e\xe4\xb8\xbd\xe4\xba\xba\xe7\x94\x9f') Out[62]: 12
看完了這篇文章,相信你對python編碼和解碼有什么區(qū)別有了一定的了解,想了解更多相關(guān)知識,歡迎關(guān)注億速云行業(yè)資訊頻道,感謝各位的閱讀!
免責(zé)聲明:本站發(fā)布的內(nèi)容(圖片、視頻和文字)以原創(chuàng)、轉(zhuǎn)載和分享為主,文章觀點(diǎn)不代表本網(wǎng)站立場,如果涉及侵權(quán)請聯(lián)系站長郵箱:is@yisu.com進(jìn)行舉報(bào),并提供相關(guān)證據(jù),一經(jīng)查實(shí),將立刻刪除涉嫌侵權(quán)內(nèi)容。