<dfn id="yhprb"><s id="yhprb"></s></dfn><dfn id="yhprb"><delect id="yhprb"></delect></dfn><dfn id="yhprb"></dfn><dfn id="yhprb"><delect id="yhprb"></delect></dfn><dfn id="yhprb"></dfn><dfn id="yhprb"><s id="yhprb"><strike id="yhprb"></strike></s></dfn><small id="yhprb"></small><dfn id="yhprb"></dfn><small id="yhprb"><delect id="yhprb"></delect></small><small id="yhprb"></small><small id="yhprb"></small> <delect id="yhprb"><strike id="yhprb"></strike></delect><dfn id="yhprb"></dfn><dfn id="yhprb"></dfn><s id="yhprb"><noframes id="yhprb"><small id="yhprb"><dfn id="yhprb"></dfn></small><dfn id="yhprb"><delect id="yhprb"></delect></dfn><small id="yhprb"></small><dfn id="yhprb"><delect id="yhprb"></delect></dfn><dfn id="yhprb"><s id="yhprb"></s></dfn> <small id="yhprb"></small><delect id="yhprb"><strike id="yhprb"></strike></delect><dfn id="yhprb"><s id="yhprb"></s></dfn><dfn id="yhprb"></dfn><dfn id="yhprb"><s id="yhprb"></s></dfn><dfn id="yhprb"><s id="yhprb"><strike id="yhprb"></strike></s></dfn><dfn id="yhprb"><s id="yhprb"></s></dfn>

新聞中心

EEPW首頁(yè) > 消費電子 > 設計應用 > 語(yǔ)音識別技術(shù)原理簡(jiǎn)介

語(yǔ)音識別技術(shù)原理簡(jiǎn)介

作者: 時(shí)間:2013-06-25 來(lái)源:網(wǎng)絡(luò ) 收藏

本文引用地址:http://dyxdggzs.com/article/164680.htm

自動(dòng)(Auto Speech Recognize,簡(jiǎn)稱(chēng)ASR)所要解決的問(wèn)題是讓計算機能夠“聽(tīng)懂”人類(lèi)的,將語(yǔ)音中包含的文字信息“提取”出來(lái)。ASR在“能聽(tīng)會(huì )說(shuō)”的智能計算機系統中扮演著(zhù)重要角色,相當于給計算機系統安裝上“耳朵”,使其具備“能聽(tīng)”的功能,進(jìn)而實(shí)現信息時(shí)代利用“語(yǔ)音”這一最自然、最便捷的手段進(jìn)行人機通信和交互。

語(yǔ)音技術(shù)所面臨的問(wèn)題是非常艱巨和困難的。盡管早在二十世紀五十年代,世界各國就開(kāi)始了對這項技術(shù)孜孜不倦的研究,特別是最近二十年,國內外非常多的研究機構和企業(yè)都加入到語(yǔ)音識別技術(shù)的研究領(lǐng)域,投入了極大的努力,也取得了豐碩的成果,但是直到今天,距離該技術(shù)得到完美解決還存在著(zhù)巨大的差距,不過(guò)這并不妨礙不斷進(jìn)步的語(yǔ)音識別系統在許多相對受限的場(chǎng)合下獲得成功的應用。

如今,語(yǔ)音識別技術(shù)已經(jīng)發(fā)展成為涉及聲學(xué)、語(yǔ)言學(xué)、數字信號處理、統計模式識別等多學(xué)科技術(shù)的一項綜合性技術(shù)?;谡Z(yǔ)音識別技術(shù)研發(fā)的現代語(yǔ)音識別系統在很多場(chǎng)景下獲得了成功的應用,不同任務(wù)條件下所采用的技術(shù)又會(huì )有所不同。下圖是在一個(gè)相對通用的任務(wù)條件下的語(yǔ)音識別系統示意圖。語(yǔ)音識別系統構建過(guò)程整體上包括兩大部分:訓練和識別。訓練通常是離線(xiàn)完成的,對預先收集好的海量語(yǔ)音、語(yǔ)言數據庫進(jìn)行信號處理和知識挖掘,獲取語(yǔ)音識別系統所需要的“聲學(xué)模型”和“語(yǔ)言模型”;而識別過(guò)程通常是在線(xiàn)完成的,對用戶(hù)實(shí)時(shí)的語(yǔ)音進(jìn)行自動(dòng)識別。識別過(guò)程通常又可以分為“前端”和“后端”兩大模塊:“前端”模塊主要的作用是進(jìn)行端點(diǎn)檢測(去除多余的靜音和非說(shuō)話(huà)聲)、降噪、特征提取等;“后端”模塊的作用是利用訓練好的“聲學(xué)模型”和“語(yǔ)言模型”對用戶(hù)說(shuō)話(huà)的特征向量進(jìn)行統計模式識別(又稱(chēng)“解碼”),得到其包含的文字信息,此外,后端模塊還存在一個(gè)“自適應”的反饋模塊,可以對用戶(hù)的語(yǔ)音進(jìn)行自學(xué)習,從而對“聲學(xué)模型”和“語(yǔ)音模型”進(jìn)行必要的“校正”,進(jìn)一步提高識別的準確率。

語(yǔ)音識別技術(shù)發(fā)展歷史及現狀

語(yǔ)音識別的研究工作大約開(kāi)始于20世紀50年代,當時(shí)ATT Bell實(shí)驗室基于共振峰提取技術(shù)實(shí)現了第一個(gè)可識別十個(gè)英文數字的語(yǔ)音識別系統——Audry系統。

60年代,計算機的應用推動(dòng)了語(yǔ)音識別的發(fā)展。這時(shí)期的重要成果是提出了動(dòng)態(tài)時(shí)間規劃(DP)和線(xiàn)性預測分析技術(shù)(LPC),其中后者較好地解決了語(yǔ)音信號產(chǎn)生模型的問(wèn)題,對語(yǔ)音識別的發(fā)展產(chǎn)生了深遠影響。

70年代,語(yǔ)音識別領(lǐng)域取得了較大進(jìn)展。在理論上,LP技術(shù)得到進(jìn)一步發(fā)展,動(dòng)態(tài)時(shí)間歸正技術(shù)(DTW)基本成熟,特別是提出了矢量量化(VQ)和隱馬爾可夫模型(HMM)理論。在實(shí)踐上,實(shí)現了基于線(xiàn)性預測倒譜和DTW技術(shù)的特定人孤立語(yǔ)音識別系統。

80年代,MFCC的參數提取技術(shù)和HMM模型的深入使用使得語(yǔ)音識別技術(shù)得到進(jìn)一步的發(fā)展,語(yǔ)音識別的問(wèn)題逐步在理論體系上得到了比較完整和準確的描述,同時(shí)在實(shí)踐上又逐步研發(fā)出效率較高的解決算法。

90年代以來(lái),在美國國防部的Darpa測試、Ears計劃、近期的Gales計劃,以及我國863計劃等推動(dòng)下,一大批高水平的研究機構和企業(yè)加入到語(yǔ)音識別的研究領(lǐng)域,極大地推動(dòng)了語(yǔ)音識別技術(shù)的發(fā)展和應用。語(yǔ)音識別系統已經(jīng)從過(guò)去的小詞匯量、孤立詞識別、特定人識別、安靜環(huán)境等簡(jiǎn)單任務(wù)逐步發(fā)展到大詞匯量、連續語(yǔ)音、非特定人、噪聲環(huán)境下的識別任務(wù),從單純的語(yǔ)音識別任務(wù)發(fā)展到語(yǔ)音翻譯任務(wù),從實(shí)驗室系統走向商用系統。

矢量控制相關(guān)文章:矢量控制原理


評論


相關(guān)推薦

技術(shù)專(zhuān)區

關(guān)閉
国产精品自在自线亚洲|国产精品无圣光一区二区|国产日产欧洲无码视频|久久久一本精品99久久K精品66|欧美人与动牲交片免费播放
<dfn id="yhprb"><s id="yhprb"></s></dfn><dfn id="yhprb"><delect id="yhprb"></delect></dfn><dfn id="yhprb"></dfn><dfn id="yhprb"><delect id="yhprb"></delect></dfn><dfn id="yhprb"></dfn><dfn id="yhprb"><s id="yhprb"><strike id="yhprb"></strike></s></dfn><small id="yhprb"></small><dfn id="yhprb"></dfn><small id="yhprb"><delect id="yhprb"></delect></small><small id="yhprb"></small><small id="yhprb"></small> <delect id="yhprb"><strike id="yhprb"></strike></delect><dfn id="yhprb"></dfn><dfn id="yhprb"></dfn><s id="yhprb"><noframes id="yhprb"><small id="yhprb"><dfn id="yhprb"></dfn></small><dfn id="yhprb"><delect id="yhprb"></delect></dfn><small id="yhprb"></small><dfn id="yhprb"><delect id="yhprb"></delect></dfn><dfn id="yhprb"><s id="yhprb"></s></dfn> <small id="yhprb"></small><delect id="yhprb"><strike id="yhprb"></strike></delect><dfn id="yhprb"><s id="yhprb"></s></dfn><dfn id="yhprb"></dfn><dfn id="yhprb"><s id="yhprb"></s></dfn><dfn id="yhprb"><s id="yhprb"><strike id="yhprb"></strike></s></dfn><dfn id="yhprb"><s id="yhprb"></s></dfn>