<meter id="pryje"><nav id="pryje"><delect id="pryje"></delect></nav></meter>

<label id="pryje"></label>

新聞中心

EEPW首頁 > 消費電子 > 設(shè)計應(yīng)用 > 語音識別技術(shù)原理簡介

語音識別技術(shù)原理簡介

作者：時間：2013-06-25 來源：網(wǎng)絡(luò)

加入技術(shù)交流群
- 掃碼加入
  和技術(shù)大咖面對面交流
  海量資料庫查詢

收藏

語音識別 技術(shù)原理簡介

本文引用地址：http://www.ex-cimer.com/article/164680.htm

自動語音識別 技術(shù)(Auto Speech Recognize，簡稱ASR)所要解決的問題是讓計算機能夠“聽懂”人類的語音，將語音中包含的文字信息“提取”出來。ASR技術(shù)在“能聽會說”的智能計算機系統(tǒng)中扮演著重要角色，相當于給計算機系統(tǒng)安裝上“耳朵”，使其具備“能聽”的功能，進而實現(xiàn)信息時代利用“語音”這一最自然、最便捷的手段進行人機通信和交互。

語音識別技術(shù)所面臨的問題是非常艱巨和困難的。盡管早在二十世紀五十年代，世界各國就開始了對這項技術(shù)孜孜不倦的研究，特別是最近二十年，國內(nèi)外非常多的研究機構(gòu)和企業(yè)都加入到語音識別技術(shù)的研究領(lǐng)域，投入了極大的努力，也取得了豐碩的成果，但是直到今天，距離該技術(shù)得到完美解決還存在著巨大的差距，不過這并不妨礙不斷進步的語音識別系統(tǒng)在許多相對受限的場合下獲得成功的應(yīng)用。

如今，語音識別技術(shù)已經(jīng)發(fā)展成為涉及聲學、語言學、數(shù)字信號處理、統(tǒng)計模式識別等多學科技術(shù)的一項綜合性技術(shù)?；谡Z音識別技術(shù)研發(fā)的現(xiàn)代語音識別系統(tǒng)在很多場景下獲得了成功的應(yīng)用，不同任務(wù)條件下所采用的技術(shù)又會有所不同。下圖是在一個相對通用的任務(wù)條件下的語音識別系統(tǒng)示意圖。語音識別系統(tǒng)構(gòu)建過程整體上包括兩大部分：訓練和識別。訓練通常是離線完成的，對預(yù)先收集好的海量語音、語言數(shù)據(jù)庫進行信號處理和知識挖掘，獲取語音識別系統(tǒng)所需要的“聲學模型”和“語言模型”;而識別過程通常是在線完成的，對用戶實時的語音進行自動識別。識別過程通常又可以分為“前端”和“后端”兩大模塊：“前端”模塊主要的作用是進行端點檢測(去除多余的靜音和非說話聲)、降噪、特征提取等;“后端”模塊的作用是利用訓練好的“聲學模型”和“語言模型”對用戶說話的特征向量進行統(tǒng)計模式識別(又稱“解碼”)，得到其包含的文字信息，此外，后端模塊還存在一個“自適應(yīng)”的反饋模塊，可以對用戶的語音進行自學習，從而對“聲學模型”和“語音模型”進行必要的“校正”，進一步提高識別的準確率。

語音識別技術(shù)發(fā)展歷史及現(xiàn)狀

語音識別的研究工作大約開始于20世紀50年代，當時ATT Bell實驗室基于共振峰提取技術(shù)實現(xiàn)了第一個可識別十個英文數(shù)字的語音識別系統(tǒng)——Audry系統(tǒng)。

60年代，計算機的應(yīng)用推動了語音識別的發(fā)展。這時期的重要成果是提出了動態(tài)時間規(guī)劃(DP)和線性預(yù)測分析技術(shù)(LPC)，其中后者較好地解決了語音信號產(chǎn)生模型的問題，對語音識別的發(fā)展產(chǎn)生了深遠影響。

70年代，語音識別領(lǐng)域取得了較大進展。在理論上，LP技術(shù)得到進一步發(fā)展，動態(tài)時間歸正技術(shù)(DTW)基本成熟，特別是提出了矢量量化(VQ)和隱馬爾可夫模型(HMM)理論。在實踐上，實現(xiàn)了基于線性預(yù)測倒譜和DTW技術(shù)的特定人孤立語音識別系統(tǒng)。

80年代，MFCC的參數(shù)提取技術(shù)和HMM模型的深入使用使得語音識別技術(shù)得到進一步的發(fā)展，語音識別的問題逐步在理論體系上得到了比較完整和準確的描述，同時在實踐上又逐步研發(fā)出效率較高的解決算法。

90年代以來，在美國國防部的Darpa測試、Ears計劃、近期的Gales計劃，以及我國863計劃等推動下，一大批高水平的研究機構(gòu)和企業(yè)加入到語音識別的研究領(lǐng)域，極大地推動了語音識別技術(shù)的發(fā)展和應(yīng)用。語音識別系統(tǒng)已經(jīng)從過去的小詞匯量、孤立詞識別、特定人識別、安靜環(huán)境等簡單任務(wù)逐步發(fā)展到大詞匯量、連續(xù)語音、非特定人、噪聲環(huán)境下的識別任務(wù)，從單純的語音識別任務(wù)發(fā)展到語音翻譯任務(wù)，從實驗室系統(tǒng)走向商用系統(tǒng)。

矢量控制相關(guān)文章:矢量控制原理

<a target='_blank'><img src='https://ad.eepw.com.cn/www/delivery/avw.php?zoneid=114&cb=INSERT_RANDOM_NUMBER_HERE&n=a7a83b30' border='0' alt='' /></a>
<a target='_blank'><img src='https://ad.eepw.com.cn/www/delivery/avw.php?zoneid=115&cb=INSERT_RANDOM_NUMBER_HERE&n=a3d98779' border='0' alt='' /></a>
<a target='_blank'><img src='https://ad.eepw.com.cn/www/delivery/avw.php?zoneid=116&cb=INSERT_RANDOM_NUMBER_HERE&n=abca108c' border='0' alt='' /></a>
<a target='_blank'><img src='https://ad.eepw.com.cn/www/delivery/avw.php?zoneid=117&cb=INSERT_RANDOM_NUMBER_HERE&n=a1775170' border='0' alt='' /></a>
<a target='_blank'><img src='https://ad.eepw.com.cn/www/delivery/avw.php?zoneid=118&cb=INSERT_RANDOM_NUMBER_HERE&n=a449048b' border='0' alt='' /></a>

關(guān)鍵詞：簡介原理 技術(shù) 識別語音

評論

相關(guān)推薦

One UI 6.1 導致 Galaxy S23 系列手機指紋識別出問題

手機與無線通信 One UI 6.1 Galaxy S23 手機指紋識別 | 2024-04-08

智能電梯控制

視頻信息技術(shù)大賽 kinetis k10 語音感應(yīng)器 | 2013-01-18

在不影響系統(tǒng)性能的情況下延長電池壽命的 3 種低 IQ 技術(shù)

電源與新能源電池壽命低 IQ 技術(shù) 德州儀器 | 2023-12-20

三星電子：目標到 2027 年將芯片代工廠產(chǎn)能提高三倍以上

EDA/PCB 三星 GAA 技術(shù) | 2022-10-21

El axer? 所有雞蛋，呃？Alexa！從噪音中拾取清晰語

智能計算 202109 語音人工智能 | 2021-09-15

微軟嵌入式技術(shù)教育大會專訪實錄(老站轉(zhuǎn))

amine | 2002-05-16

[新書介紹]: 嵌入式計算系統(tǒng)設(shè)計原理(老站轉(zhuǎn))

amine | 2002-05-16

基于ESP32S3的智能家居控制面板系統(tǒng)設(shè)計

202308 ESP32S3 智能家居控制面板 WiFi 語音 | 2023-08-26

2 語音云開放平臺介紹

視頻科大訊飛 Android 語音 | 2015-07-07

智能型多芯片數(shù)碼語音錄放電路

資源下載語音芯片數(shù)碼錄放電路 | 2007-12-25

用電阻進行D／A轉(zhuǎn)換的原理

設(shè)計方案電阻進行轉(zhuǎn)換原理 | 2009-07-06

瑞薩推出面向圖形顯示應(yīng)用和語音/視覺多模態(tài)AI應(yīng)用的全新RA8 MCU產(chǎn)品群

嵌入式系統(tǒng) 瑞薩圖形顯示應(yīng)用語音/視覺多模態(tài)AI MCU | 2023-12-12

1 科大訊飛語音服務(wù)概述

視頻科大訊飛 Android 語音 | 2015-07-07

AM調(diào)制的原理(集電極調(diào)制)

設(shè)計方案調(diào)制原理集電極 | 2009-07-06

蘋果布局醫(yī)療健康熱情不減，這一次瞄準了抑郁癥識別

醫(yī)療電子蘋果抑郁癥識別 | 2021-09-22

SSB調(diào)制的原理

設(shè)計方案調(diào)制原理 | 2009-07-06

基于語音和紅外遙控的無線病床呼叫控制系統(tǒng)*

醫(yī)療電子語音紅外遙控單片機醫(yī)護人員病人 202105 | 2021-05-13

仿真器概念及實現(xiàn)技術(shù)

jackwang | 2002-05-14

便攜式有害氣體預(yù)警器

視頻信息技術(shù)大賽單片機 STC15F2K60S2 傳感器語音便攜式 | 2013-01-18

亞馬遜硬件部門今年或虧損100億美元語音助手成\"無底洞\"

消費電子亞馬遜硬件語音 | 2022-11-23

USB系統(tǒng)研究

資源下載 USB 技術(shù) USB 協(xié)議 USB 總線總線拓撲體系 | 2007-02-09

SSB調(diào)制的原理

設(shè)計方案調(diào)制原理 | 2009-07-06

AI語音獨角獸“思必馳”宣布完成數(shù)億元Pre-IPO輪融資

消費電子 AI 語音獨角獸思必馳 | 2020-08-27

微軟2002嵌入式技術(shù)教育大會情況（4月11-12）北京(老站轉(zhuǎn))

amine | 2002-05-16

可控硅元件的工作原理及基本特性電路

設(shè)計方案可控硅元件工作原理基本特性電路 | 2009-07-06

PID控制

資源下載 PID控制溫度控制原理 | 2007-02-16

多路語音同傳系統(tǒng)

視頻信息技術(shù)大賽 FPGA EP1C3T100C8N 語音 | 2013-01-16

AVR單片機

資源下載 ATMEL公司 AVR單片機簡介 | 2007-02-16

API840N 40秒多功能可編程語音電路

資源下載語音語音電路 API840N 40秒 | 2007-12-25

ARM簡介及編程

jackwang | 2002-05-15

焦點

推薦視頻

技術(shù)專區(qū)

看屁屁www成人影院,亚洲人妻成人图片,亚洲精品成人午夜在线,日韩在线欧美成人 (function(){ var bp = document.createElement('script'); var curProtocol = window.location.protocol.split(':')[0]; if (curProtocol === 'https') { bp.src = 'https://zz.bdstatic.com/linksubmit/push.js'; } else { bp.src = 'http://push.zhanzhang.baidu.com/push.js'; } var s = document.getElementsByTagName("script")[0]; s.parentNode.insertBefore(bp, s); })();