溫馨提示×

溫馨提示×

您好,登錄后才能下訂單哦!

密碼登錄×
登錄注冊×
其他方式登錄
點擊 登錄注冊 即表示同意《億速云用戶服務(wù)條款》

python版百度語音識別功能

發(fā)布時間:2020-09-12 15:37:35 來源:腳本之家 閱讀:128 作者:fengda2870 欄目:開發(fā)技術(shù)

本文實例為大家分享了python版百度語音識別功能的具體代碼,供大家參考,具體內(nèi)容如下

環(huán)境:使用的IDE是Pycharm

1.新建工程

2.配置百度語音識別環(huán)境

“File”——“Settings”打開設(shè)置面板,“Project”標(biāo)簽下添加Project Interpreter,點擊右側(cè)“+”

python版百度語音識別功能

輸入“baidu-aip”,進(jìn)行安裝

python版百度語音識別功能

新建測試文件

from aip import AipSpeech
 
""" 你的 APPID AK SK """
APP_ID = '******'
API_KEY = '******'
SECRET_KEY = '******'
 
client = AipSpeech(APP_ID, API_KEY, SECRET_KEY)
 
# 讀取文件
def get_file_content(filePath):
 with open(filePath, 'rb') as fp:
  return fp.read()
 
# 識別本地文件
test1 = client.asr(get_file_content('test.pcm'), 'pcm', 16000, {'dev_pid': 1536,})
print(test1)

注意:提交的音頻文件格式推薦是PCM,采樣率16K,16位,單聲道。

轉(zhuǎn)換的文字準(zhǔn)確率還是可以的,但是沒有標(biāo)點符號,這一點比較不滿意:

{'corpus_no': '6670746770877419029', 'err_msg': 'success.', 'err_no': 0, 'result': ['這里是語音轉(zhuǎn)換的結(jié)果看不到標(biāo)點符號'], 'sn': '29336209551553154264'} 

以上就是本文的全部內(nèi)容,希望對大家的學(xué)習(xí)有所幫助,也希望大家多多支持億速云。

向AI問一下細(xì)節(jié)

免責(zé)聲明:本站發(fā)布的內(nèi)容(圖片、視頻和文字)以原創(chuàng)、轉(zhuǎn)載和分享為主,文章觀點不代表本網(wǎng)站立場,如果涉及侵權(quán)請聯(lián)系站長郵箱:is@yisu.com進(jìn)行舉報,并提供相關(guān)證據(jù),一經(jīng)查實,將立刻刪除涉嫌侵權(quán)內(nèi)容。

AI