四虎永久在线精品8848A-97人人超碰国产精品最新o-国产不卡一区在线视频-亚洲精品永久在线观看

啟達(dá)軟件-基于互聯(lián)網(wǎng),致力于企業(yè)信息化、ERP、CRM、互聯(lián)網(wǎng)+的軟件開(kāi)發(fā)
啟達(dá)軟件
啟達(dá)軟件電話
技術(shù)文章你現(xiàn)的位置:首頁(yè)>文章列表>技術(shù)文章
讓訊飛驕傲的語(yǔ)音識(shí)別技術(shù)
                大家可能手機(jī)上用到過(guò)訊飛輸入法,也知道訊飛輸入法的強(qiáng)大之處,作為專業(yè)的手機(jī)輸入法服務(wù)端,訊飛的輸入無(wú)疑是一個(gè)偉大的成就,就連去年的錘子手機(jī)也讓訊飛火了一把?,F(xiàn)在我們就聊聊訊飛的語(yǔ)音識(shí)別技術(shù)吧。
        什么是語(yǔ)音識(shí)別技術(shù)?
        語(yǔ)音識(shí)別技術(shù),也被稱為自動(dòng)語(yǔ)音識(shí)別Automatic    Speech    Recognition,(ASR),其目標(biāo)是將人類的語(yǔ)音中的詞匯內(nèi)容轉(zhuǎn)換為計(jì)算機(jī)可讀的輸入,例如按鍵、二進(jìn)制編碼或者字符序列。與說(shuō)話人識(shí)別及說(shuō)話人確認(rèn)不同,后者嘗試識(shí)別或確認(rèn)發(fā)出語(yǔ)音的說(shuō)話人而非其中所包含的詞匯內(nèi)容。
        語(yǔ)音識(shí)別的原理:
        語(yǔ)音識(shí)別系統(tǒng)本質(zhì)上是一種模式識(shí)別系統(tǒng),包括特征提取、模式匹配、參考模式庫(kù)等三個(gè)基本單元。未知語(yǔ)音經(jīng)過(guò)話筒變換成電信號(hào)后加在識(shí)別系統(tǒng)的輸入端,首先經(jīng)過(guò)預(yù)處理,再根據(jù)人的語(yǔ)音特點(diǎn)建立語(yǔ)音模型,對(duì)輸入的語(yǔ)音信號(hào)進(jìn)行分析,并抽取所需的特征,在此基礎(chǔ)上建立語(yǔ)音識(shí)別所需的模板。而計(jì)算機(jī)在識(shí)別過(guò)程中要根據(jù)語(yǔ)音識(shí)別的模型,將計(jì)算機(jī)中存放的語(yǔ)音模板與輸入的語(yǔ)音信號(hào)的特征進(jìn)行比較,根據(jù)一定的搜索和匹配策略,找出一系列最優(yōu)的與輸入語(yǔ)音匹配的模板。然后根據(jù)此模板的定義,通過(guò)查表就可以給出計(jì)算機(jī)的識(shí)別結(jié)果。顯然,這種最優(yōu)的結(jié)果與特征的選擇、語(yǔ)音模型的好壞、模板是否準(zhǔn)確都有直接的關(guān)系。

          語(yǔ)音識(shí)別系統(tǒng)構(gòu)建過(guò)程整體上包括兩大部分:訓(xùn)練和識(shí)別。訓(xùn)練通常是離線完成的,對(duì)預(yù)先收集好的海量語(yǔ)音、語(yǔ)言數(shù)據(jù)庫(kù)進(jìn)行信號(hào)處理和知識(shí)挖掘,獲取語(yǔ)音識(shí)別系統(tǒng)所需要的“聲學(xué)模型”和“語(yǔ)言模型”;而識(shí)別過(guò)程通常是在線完成的,對(duì)用戶實(shí)時(shí)的語(yǔ)音進(jìn)行自動(dòng)識(shí)別。識(shí)別過(guò)程通常又可以分為“前端”和“后端”兩大模塊:“前端”模塊主要的作用是進(jìn)行端點(diǎn)檢測(cè)(去除多余的靜音和非說(shuō)話聲)、降噪、特征提取等;“后端”模塊的作用是利用訓(xùn)練好的“聲學(xué)模型”和“語(yǔ)言模型”對(duì)用戶說(shuō)話的特征向量進(jìn)行統(tǒng)計(jì)模式識(shí)別(又稱“解碼”),得到其包含的文字信息,此外,后端模塊還存在一個(gè)“自適應(yīng)”的反饋模塊,可以對(duì)用戶的語(yǔ)音進(jìn)行自學(xué)習(xí),從而對(duì)“聲學(xué)模型”和“語(yǔ)音模型”進(jìn)行必要的“校正”,進(jìn)一步提高識(shí)別的準(zhǔn)確率。
        語(yǔ)音識(shí)別的應(yīng)用:
        可以應(yīng)用的領(lǐng)域大致分為大五類:
        辦公室或商務(wù)系統(tǒng)。典型的應(yīng)用包括:填寫(xiě)數(shù)據(jù)表格、數(shù)據(jù)庫(kù)管理和控制、鍵盤(pán)功能增強(qiáng)等等。
        制造業(yè):在質(zhì)量控制中,語(yǔ)音識(shí)別系統(tǒng)可以為制造過(guò)程提供一種“不用手”、“不用眼”的檢控(部件檢查)。
        電信:相當(dāng)廣泛的一類應(yīng)用在撥號(hào)電話系統(tǒng)上都是可行的,包括話務(wù)員協(xié)助服務(wù)的自動(dòng)化、國(guó)際國(guó)內(nèi)遠(yuǎn)程電子商務(wù)、語(yǔ)音呼叫分配、語(yǔ)音撥號(hào)、分類訂貨。
        醫(yī)療:這方面的主要應(yīng)用是由聲音來(lái)生成和編輯專業(yè)的醫(yī)療報(bào)告。
        其他:包括由語(yǔ)音控制和操作的游戲和玩具、幫助殘疾人的語(yǔ)音識(shí)別系統(tǒng)、車輛行駛中一些非關(guān)鍵功能的語(yǔ)音控制,如車載交通路況控制系統(tǒng)、音響系統(tǒng)。
        那么最接近我們生活的就是我們手機(jī)輸入法的語(yǔ)音輸入識(shí)別了,可以說(shuō)訊飛的語(yǔ)音識(shí)別技術(shù)已經(jīng)達(dá)到了很牛叉的地步了,不僅支持普通話,英語(yǔ)。而且還支持我們中國(guó)的方言,所以,訊飛的技術(shù)對(duì)于中國(guó)語(yǔ)音的發(fā)展是起到了推動(dòng)的作用。
 
開(kāi)發(fā)框架.pdf  生產(chǎn)行業(yè)案例.pdf

版權(quán)所有:合肥啟達(dá)信息技術(shù)有限公司 備案號(hào):皖I(lǐng)CP備12015909號(hào)-6 Copyright 2001-2012 All rights reserved

皖公網(wǎng)安備 34010402701105號(hào)