溫馨提示×

溫馨提示×

您好,登錄后才能下訂單哦!

密碼登錄×
登錄注冊×
其他方式登錄
點(diǎn)擊 登錄注冊 即表示同意《億速云用戶服務(wù)條款》

使用PHP怎么獲取中英混合字符串的長度

發(fā)布時(shí)間:2020-12-30 15:13:18 來源:億速云 閱讀:202 作者:Leah 欄目:開發(fā)技術(shù)

使用PHP怎么獲取中英混合字符串的長度?針對這個(gè)問題,這篇文章詳細(xì)介紹了相對應(yīng)的分析和解答,希望可以幫助更多想解決這個(gè)問題的小伙伴找到更簡單易行的方法。

 代碼如下:


$str = 'Hello world!';
echo strlen($str); // 輸出12


然而在PHP自帶的函數(shù)中,strlen及mb_strlen都是通過計(jì)算字符串所占字節(jié)數(shù)來計(jì)算長度的,在不同的編碼情況下,中文所占的字節(jié)數(shù)是不同的。在GBK/GB2312下,中文字符占2個(gè)字節(jié),而在UTF-8下,中文字符占3個(gè)字節(jié)。

復(fù)制代碼 代碼如下:


$str = '你好,世界!';
echo strlen($str); // GBK或GB2312下輸出12,UTF-8下輸出18


而我們在判斷字符串長度時(shí)往往需要判斷的是字符的數(shù)量,而非字符串所占字節(jié)數(shù),如在UTF-8下的這段PHP代碼:

復(fù)制代碼 代碼如下:


$name = '張耕暢';
$len = strlen($name);
// 輸出 FALSE,因?yàn)樵赨TF-8下三個(gè)中文占9個(gè)字節(jié)
if($len >= 3 && $len <= 8){
 echo 'TRUE';
}else{
 echo 'FALSE';
}


那么有什么方便而實(shí)用的方法可以獲得含中文字符串的長度呢?可以用正則計(jì)算出中文字符的個(gè)數(shù),在GBK/GB2312編碼下除以2,UTF-8編碼下則除以3,最后再加上非中文字符串的長度,但這樣未免太過麻煩。

WordPress這么一段代碼,借鑒如下:

復(fù)制代碼 代碼如下:


$str = 'Hello,世界!';
preg_match_all('/./us', $str, $match);
echo count($match[0]); // 輸出9


思想是用正則表達(dá)式將字符串分割成單個(gè)字符,并直接用count計(jì)算出匹配到的字符數(shù),便是我們想要的結(jié)果了。

但以上代碼在UTF-8編碼下并不能處理GBK/GB2312的中文字符串,因?yàn)镚BK/GB2312的中文字符會(huì)被識別為兩個(gè)字符而計(jì)算出來的中文字符數(shù)量會(huì)翻倍,于是我想到了這么一個(gè)辦法:

復(fù)制代碼 代碼如下:


$tmp = @iconv('gbk', 'utf-8', $str);
if(!empty($tmp)){
 $str = $tmp;
}
preg_match_all('/./us', $str, $match);
echo count($match[0]);


可兼容GBK/GB2312及UTF-8編碼,經(jīng)小量數(shù)據(jù)測試通過,但暫未確定是否完全正確,盼有大牛指點(diǎn)一二。

以上本意是為了框架可以兼容多種編碼格式,但一般在日常開發(fā)中,一個(gè)項(xiàng)目是已經(jīng)可以確定為何種編碼的,因此可以使用以下函數(shù)來方便地獲取字符串長度:

復(fù)制代碼 代碼如下:


int iconv_strlen ( string $str [, string $charset = ini_get("iconv.internal_encoding") ] )

關(guān)于使用PHP怎么獲取中英混合字符串的長度問題的解答就分享到這里了,希望以上內(nèi)容可以對大家有一定的幫助,如果你還有很多疑惑沒有解開,可以關(guān)注億速云行業(yè)資訊頻道了解更多相關(guān)知識。

向AI問一下細(xì)節(jié)

免責(zé)聲明:本站發(fā)布的內(nèi)容(圖片、視頻和文字)以原創(chuàng)、轉(zhuǎn)載和分享為主,文章觀點(diǎn)不代表本網(wǎng)站立場,如果涉及侵權(quán)請聯(lián)系站長郵箱:is@yisu.com進(jìn)行舉報(bào),并提供相關(guān)證據(jù),一經(jīng)查實(shí),將立刻刪除涉嫌侵權(quán)內(nèi)容。

AI