您好,登錄后才能下訂單哦!
這篇文章給大家分享的是有關(guān)python中正則過(guò)濾字母、中文、數(shù)字及特殊字符的示例分析的內(nèi)容。小編覺(jué)得挺實(shí)用的,因此分享給大家做個(gè)參考,一起跟隨小編過(guò)來(lái)看看吧。
去除數(shù)字,特殊字符,只保留漢字
import re s = '1123*#$ 中abc國(guó)' str = re.sub('[a-zA-Z0-9'!"#$%&\'()*+,-./:;<=>?@,。?★、…【】《》?“”‘'![\\]^_`{|}~\s]+', "", s) # 去除不可見(jiàn)字符 str = re.sub('[\001\002\003\004\005\006\007\x08\x09\x0a\x0b\x0c\x0d\x0e\x0f\x10\x11\x12\x13\x14\x15\x16\x17\x18\x19\x1a]+', '', x) print(str) # 結(jié)果為:中國(guó)
去除特殊字符,只保留漢子,字母、數(shù)字
import re string = "123我123456abcdefgABCVDFF?/ ,。,.:;:''';'''[]{}()()《》" print(string) 123我123456abcdefgABCVDFF?/ ,。,.:;:''';'''[]{}()()《》 sub_str = re.sub(u"([^\u4e00-\u9fa5\u0030-\u0039\u0041-\u005a\u0061-\u007a])","",string) print(sub_str) 123我123456abcdefgABCVDFF
正則表達(dá)式說(shuō)明
函數(shù) | 說(shuō)明 |
sub(pattern,repl,string) | 把字符串中的所有匹配表達(dá)式pattern中的地方替換成repl |
[^**] | 表示不匹配此字符集中的任何一個(gè)字符 |
\u4e00-\u9fa5 | 漢字的unicode范圍 |
\u0030-\u0039 | 數(shù)字的unicode范圍 |
\u0041-\u005a | 大寫(xiě)字母unicode范圍 |
\u0061-\u007a | 小寫(xiě)字母unicode范圍 |
\uAC00-\uD7AF | 韓文的unicode范圍 |
\u3040-\u31FF | 日文的unicode范圍 |
感謝各位的閱讀!關(guān)于“python中正則過(guò)濾字母、中文、數(shù)字及特殊字符的示例分析”這篇文章就分享到這里了,希望以上內(nèi)容可以對(duì)大家有一定的幫助,讓大家可以學(xué)到更多知識(shí),如果覺(jué)得文章不錯(cuò),可以把它分享出去讓更多的人看到吧!
免責(zé)聲明:本站發(fā)布的內(nèi)容(圖片、視頻和文字)以原創(chuàng)、轉(zhuǎn)載和分享為主,文章觀點(diǎn)不代表本網(wǎng)站立場(chǎng),如果涉及侵權(quán)請(qǐng)聯(lián)系站長(zhǎng)郵箱:is@yisu.com進(jìn)行舉報(bào),并提供相關(guān)證據(jù),一經(jīng)查實(shí),將立刻刪除涉嫌侵權(quán)內(nèi)容。