大家可能手機(jī)上用到過訊飛輸入法,也知道訊飛輸入法的強(qiáng)大之處,作為專業(yè)的手機(jī)輸入法服務(wù)端,訊飛的輸入無疑是一個(gè)偉大的成就,就連去年的錘子手機(jī)也讓訊飛火了一把?,F(xiàn)在我們就聊聊訊飛的語音識(shí)別技術(shù)吧。 什么是語音識(shí)別技術(shù)? 語音識(shí)別技術(shù),也被稱為自動(dòng)語音識(shí)別Automatic Speech Recognition,(ASR),其目標(biāo)是將人類的語音中的詞匯內(nèi)容轉(zhuǎn)換為計(jì)算機(jī)可讀的輸入,例如按鍵、二進(jìn)制編碼或者字符序列。與說話人識(shí)別及說話人確認(rèn)不同,后者嘗試識(shí)別或確認(rèn)發(fā)出語音的說話人而非其中所包含的詞匯內(nèi)容。 語音識(shí)別的原理: 語音識(shí)別系統(tǒng)本質(zhì)上是一種模式識(shí)別系統(tǒng),包括特征提取、模式匹配、參考模式庫等三個(gè)基本單元。未知語音經(jīng)過話筒變換成電信號(hào)后加在識(shí)別系統(tǒng)的輸入端,首先經(jīng)過預(yù)處理,再根據(jù)人的語音特點(diǎn)建立語音模型,對(duì)輸入的語音信號(hào)進(jìn)行分析,并抽取所需的特征,在此基礎(chǔ)上建立語音識(shí)別所需的模板。而計(jì)算機(jī)在識(shí)別過程中要根據(jù)語音識(shí)別的模型,將計(jì)算機(jī)中存放的語音模板與輸入的語音信號(hào)的特征進(jìn)行比較,根據(jù)一定的搜索和匹配策略,找出一系列最優(yōu)的與輸入語音匹配的模板。然后根據(jù)此模板的定義,通過查表就可以給出計(jì)算機(jī)的識(shí)別結(jié)果。顯然,這種最優(yōu)的結(jié)果與特征的選擇、語音模型的好壞、模板是否準(zhǔn)確都有直接的關(guān)系。 語音識(shí)別系統(tǒng)構(gòu)建過程整體上包括兩大部分:訓(xùn)練和識(shí)別。訓(xùn)練通常是離線完成的,對(duì)預(yù)先收集好的海量語音、語言數(shù)據(jù)庫進(jìn)行信號(hào)處理和知識(shí)挖掘,獲取語音識(shí)別系統(tǒng)所需要的“聲學(xué)模型”和“語言模型”;而識(shí)別過程通常是在線完成的,對(duì)用戶實(shí)時(shí)的語音進(jìn)行自動(dòng)識(shí)別。識(shí)別過程通常又可以分為“前端”和“后端”兩大模塊:“前端”模塊主要的作用是進(jìn)行端點(diǎn)檢測(cè)(去除多余的靜音和非說話聲)、降噪、特征提取等;“后端”模塊的作用是利用訓(xùn)練好的“聲學(xué)模型”和“語言模型”對(duì)用戶說話的特征向量進(jìn)行統(tǒng)計(jì)模式識(shí)別(又稱“解碼”),得到其包含的文字信息,此外,后端模塊還存在一個(gè)“自適應(yīng)”的反饋模塊,可以對(duì)用戶的語音進(jìn)行自學(xué)習(xí),從而對(duì)“聲學(xué)模型”和“語音模型”進(jìn)行必要的“校正”,進(jìn)一步提高識(shí)別的準(zhǔn)確率。 語音識(shí)別的應(yīng)用: 可以應(yīng)用的領(lǐng)域大致分為大五類: 辦公室或商務(wù)系統(tǒng)。典型的應(yīng)用包括:填寫數(shù)據(jù)表格、數(shù)據(jù)庫管理和控制、鍵盤功能增強(qiáng)等等。 制造業(yè):在質(zhì)量控制中,語音識(shí)別系統(tǒng)可以為制造過程提供一種“不用手”、“不用眼”的檢控(部件檢查)。 電信:相當(dāng)廣泛的一類應(yīng)用在撥號(hào)電話系統(tǒng)上都是可行的,包括話務(wù)員協(xié)助服務(wù)的自動(dòng)化、國(guó)際國(guó)內(nèi)遠(yuǎn)程電子商務(wù)、語音呼叫分配、語音撥號(hào)、分類訂貨。 醫(yī)療:這方面的主要應(yīng)用是由聲音來生成和編輯專業(yè)的醫(yī)療報(bào)告。 其他:包括由語音控制和操作的游戲和玩具、幫助殘疾人的語音識(shí)別系統(tǒng)、車輛行駛中一些非關(guān)鍵功能的語音控制,如車載交通路況控制系統(tǒng)、音響系統(tǒng)。 那么最接近我們生活的就是我們手機(jī)輸入法的語音輸入識(shí)別了,可以說訊飛的語音識(shí)別技術(shù)已經(jīng)達(dá)到了很牛叉的地步了,不僅支持普通話,英語。而且還支持我們中國(guó)的方言,所以,訊飛的技術(shù)對(duì)于中國(guó)語音的發(fā)展是起到了推動(dòng)的作用。 |
版權(quán)所有:合肥啟達(dá)信息技術(shù)有限公司 備案號(hào):皖I(lǐng)CP備12015909號(hào)-6 Copyright 2001-2012 All rights reserved