您好,登錄后才能下訂單哦!
給定一個(gè)字符串,如何得到其中重復(fù)模式最高的子字符串,我采用的方法是使用滑窗機(jī)制,對(duì)給定的字符串切分,窗口的大小從1增加到字符串長(zhǎng)度減1,將所有的得到的切片統(tǒng)計(jì)結(jié)果,在這里不考慮單個(gè)字符的重復(fù)模式,好了,很簡(jiǎn)單看具體實(shí)現(xiàn):
#!usr/binenv python #encoding:utf-8 ''' __Author__:沂水寒城 統(tǒng)計(jì)一個(gè)給定字符串中重復(fù)模式數(shù)量得到最高重復(fù)模式串 ''' def slice(num_str,w): ''' 對(duì)輸入的字符串滑窗切片返回結(jié)果列表 ''' result_list=[] for i in range(len(num_str)-w+1): result_list.append(num_str[i:i+w]) return result_list def get_repeat_num_seq(num_str): ''' 統(tǒng)計(jì)重復(fù)模式串?dāng)?shù)量 ''' result_dict={} result_list=[] for i in range(2,len(num_str)): one_list=slice(num_str, i) result_list+=one_list for i in range(len(result_list)): if result_list[i] in result_dict: result_dict[result_list[i]]+=1 else: result_dict[result_list[i]]=1 sorted_result_dict=sorted(result_dict.items(), key=lambda e:e[1], reverse=True) return sorted_result_dict[0:10] if __name__ == '__main__': num_list=get_repeat_num_seq('4513785645121214545454545457894') print num_list
結(jié)果如下:
[('45', 8), ('4545', 5), ('454', 5), ('545', 5), ('54', 5), ('5454', 4), ('454545', 4), ('45454', 4), ('54545', 4), ('545454', 3)] [Finished in 0.5s]
結(jié)果列表中第一個(gè)即為所求,當(dāng)然,基于此還可以繼續(xù)改進(jìn)有很多別的需求。
以上這篇python獲取指定字符串中重復(fù)模式最高的字符串方法就是小編分享給大家的全部?jī)?nèi)容了,希望能給大家一個(gè)參考,也希望大家多多支持億速云。
免責(zé)聲明:本站發(fā)布的內(nèi)容(圖片、視頻和文字)以原創(chuàng)、轉(zhuǎn)載和分享為主,文章觀點(diǎn)不代表本網(wǎng)站立場(chǎng),如果涉及侵權(quán)請(qǐng)聯(lián)系站長(zhǎng)郵箱:is@yisu.com進(jìn)行舉報(bào),并提供相關(guān)證據(jù),一經(jīng)查實(shí),將立刻刪除涉嫌侵權(quán)內(nèi)容。