国产精品久久久aaaa,日日干夜夜操天天插,亚洲乱熟女香蕉一区二区三区少妇,99精品国产高清一区二区三区,国产成人精品一区二区色戒,久久久国产精品成人免费,亚洲精品毛片久久久久,99久久婷婷国产综合精品电影,国产一区二区三区任你鲁

0
  • 聊天消息
  • 系統消息
  • 評論與回復
登錄后你可以
  • 下載海量資料
  • 學習在線課程
  • 觀看技術視頻
  • 寫文章/發帖/加入社區
會員中心
創作中心

完善資料讓更多小伙伴認識你,還能領取20積分哦,立即完善>

3天內不再提示

語音識別技術的發展史

454398 ? 來源:工程師吳畏 ? 2019-04-30 11:49 ? 次閱讀
加入交流群
微信小助手二維碼

掃碼添加小助手

加入工程師交流群

從前年開始,海外谷歌、亞馬遜、蘋果、微軟、三星,國內阿里、小米、京東等都已先后涉足智能音箱這一領域。隨著其快速發展,作為核心技術之一的語音識別技術也逐步進入人們的視線,本篇我們就來談談語音識別技術。

語音識別技術簡介

語音識別,也被稱為自動語音識別(Automatic Speech Recognition,ASR)技術,就是讓機器通過識別和理解過程把語音信號轉變為相應的文本或命令的高技術,也就是讓機器聽懂人類的語音。

所謂聽懂,有兩層意思,一是指把用戶所說的話逐詞逐句轉換成文本;二是指正確理解語音中所包含的要求,作出正確的應答。

語音識別技術目前在桌面系統、智能手機、導航設備等嵌入式領域均有一定程度的應用。

語音識別系統及過程

不同的語音識別系統,雖然具體實現細節有所不同,但所采用的基本技術相似,一個典型語音識別系統的實現過程如下圖所示。

語音識別的基本過程有兩個部分組成。一是學習和訓練,二是識別過程。

訓練(Training):預先分析出語音特征參數,制作語音模板(Template)并存放在語音參數庫中。

識別(Recognition):待識語音經過與訓練時相同的分析,得到語音參數,將它與庫中的參考模板一一比較,并采用判決的方法找出最接近語音特征的模板,得出識別效果。

語音識別系統的分類

(1)根據對說話人說話方式的要求,可以分為孤立字(詞)語音識別系統,連接字語音識別系統以及連續語音識別系統。

孤立單詞識別(Isolated Word Recognition):識別的單元為字、詞或短語,它們組成識別的詞匯表(Vocabulary),對它們中的每一個通過訓練建立模板或模型。

連續單詞識別(Connected Word Recognition):以比較少的詞匯為對象,能夠完全識別每個詞。識別的詞匯表和標準樣板或模型也是字、詞或短語,但識別時可以是它們中間幾個的連續。

連續語音識別(Continuous Speech Recognition):以多數詞匯為對象,待識語音是一些完整的句子。雖不能完全準確識別每個單詞,但能夠理解其意義,連續語音識別也叫會話語音識別。可理解為在語音識別之后,根據語言學知識來推斷語音的含義內容。

(2)根據對說話人的依賴程度可以分為特定人和非特定人語音識別系統。

特定人語音識別(Speaker-Dependent):語音識別的標準模板或模型只適應于某個人。實際上,該模板或模型就是該人通過輸入詞匯表中的每個字、詞或短語的語音建立起來的。其他人使用時,需同樣建立自己的標準模板或模型。

非特定人語音識別(Speaker-Independent):語音識別的標準模板或模型適應于指定的某一范疇的說話人(比如標準普通話),標準模板或模型由該范疇的多個人通過訓練而產生。識別時可供參加訓練的發音人使用,也可供未參加訓練的同一范疇的發音人使用。

(3)根據詞匯量大小,可以分為有限詞匯以及無限詞匯量語音識別系統。

有限詞匯識別:按詞匯表中字、詞或短句個數的多少,大致分為:100以下小詞匯量;100-1000中等詞匯量;1000以上為大詞匯量。

無限詞匯識別(全音節識別):當識別基元為漢語普通話中對應所有漢字的可讀音節時,稱其為全音節語音識別,是實現無線詞匯或中文文本輸入的基礎。

語音識別技術的“前世今生”

下面我們來看看語音識別技術的“前世今生”:

(1)起始階段

1952年AT& T Bell實驗室實現了一個單一發音人孤立發音的十個英文數字的語音識別系統,方法主要是度量每個數字的元音音段的共振峰。

1960年英國的Denes等人研究成功了第一個計算機語音識別系統。在此期間,提出的一些思想沿用至今。

理論:模式識別思想、動態規劃算法、時間規劃算法、動態因素跟蹤法。

(2)快速發展階段

70年代孤立詞發音和孤立語句發音的識別成為了可行的有用技術,大規模的語音識別研究在這個時期得到很大的發展。

80年代研究的重點轉向了詞匯量的積累,以及連續的語音識別,也就是從傳統的基于標準模板匹配的技術思路轉變基于統計模型的技術思路。此外,再次提出了將神經網絡技術引入語音識別的技術思路。

理論:聲學模型—隱馬爾科夫模型(Hidden Markov Model,HMM)

語言模型—N-gram模型

(3)應用開發

90年代,語音識別研究的重點轉向自然語言的識別處理,任務轉移到航空旅行信息的索取。同時,語音識別技術不斷應用于電話網絡,增強話務員服務和自動化。

2000年以來,人機語音交互成為研究的焦點。研究重點包括即興口語的識別和理解,自然口語對話,以及多語種的語音同聲翻譯。

理論:聲學模型—隱馬爾科夫模型—深度神經網絡(Deep Neural Network,DNN)

語言模型—N-gram模型—反饋神經網絡(Feedback Neural Network,FNN)

語音識別領域公司

科大訊飛,騰訊,百度,蘇州思必馳,捷通華聲,云知聲等等。

結語

隨著語音識別技術的不斷發展,無論是Siri、Echo,還是其他的智能語音助手都可以接觸和管理消息、郵件和日程帳號,還能控制聯網家居,播放音樂,甚至完成網絡搜索或者更多的事情。而我們,只需滿懷期待。

聲明:本文內容及配圖由入駐作者撰寫或者入駐合作網站授權轉載。文章觀點僅代表作者本人,不代表電子發燒友網立場。文章及其配圖僅供工程師學習之用,如有內容侵權或者其他違規問題,請聯系本站處理。 舉報投訴
  • 語音識別
    +關注

    關注

    39

    文章

    1812

    瀏覽量

    116048
收藏 人收藏
加入交流群
微信小助手二維碼

掃碼添加小助手

加入工程師交流群

    評論

    相關推薦
    熱點推薦

    語音識別IC分類,語音識別芯片的工作原理

    語音識別芯片,也叫語音識別集成電路,是一種集聲音存儲、播放、錄音及語音識別功能于一體的專用芯片。
    的頭像 發表于 01-14 15:22 ?241次閱讀
    <b class='flag-5'>語音</b><b class='flag-5'>識別</b>IC分類,<b class='flag-5'>語音</b><b class='flag-5'>識別</b>芯片的工作原理

    國產32位MCU語音識別方案

    在智能家居、工業控制及便攜設備領域,語音交互正成為人機界面的重要發展方向。針對離線語音識別需求,基于國產32位MCU的解決方案日益成熟,其中以CH32V307等為代表的32位MCU芯片
    的頭像 發表于 12-04 15:11 ?544次閱讀

    語音識別芯片有哪些(語音識別芯片AT680系列)

    在人工智能技術飛速發展的今天,語音識別芯片作為人機交互的重要橋梁,正逐漸成為各類智能設備不可或缺的核心部件。與傳統的語音芯片不同,
    的頭像 發表于 11-14 17:11 ?1372次閱讀

    廣州唯創電子WTK6900H-24SS語音識別芯片:智能語音控制賦能臺燈創新應用 | 語音IC廠家

    在智能家居快速發展的今天,語音交互技術正在深刻改變人們與家居設備的互動方式。臺燈作為日常生活中不可或缺的照明工具,其智能化升級已成為行業發展的重要趨勢。廣州唯創電子作為國內領先的
    的頭像 發表于 11-05 09:20 ?781次閱讀
    廣州唯創電子WTK6900H-24SS<b class='flag-5'>語音</b><b class='flag-5'>識別</b>芯片:智能<b class='flag-5'>語音</b>控制賦能臺燈創新應用 | <b class='flag-5'>語音</b>IC廠家

    什么是離線語音識別芯片(離線語音識別芯片有哪些優點)

    離線語音識別芯片,是一種集成了語音信號采集、前端處理和本地識別功能的專用集成電路,無須聯網也可以進行語音控制。它內設先進的數字信號處理模塊及
    的頭像 發表于 10-31 15:27 ?508次閱讀

    如何選擇合適的語音識別芯片型號

    語音識別芯片(又稱語音識別IC)是現代智能設備的核心組件,與傳統語音芯片相比,其最大特點是能夠主動識別
    的頭像 發表于 10-30 16:32 ?615次閱讀

    廣州唯創電子WTK6900H-32N語音識別芯片:AI降噪算法助力抽油煙機精準語音控制 | 語音IC廠家

    在現代智能家居快速發展的大背景下,廚房作為家庭生活的重要場景,其智能化程度卻一直受到環境噪音的制約。抽油煙機作為廚房核心電器,其運行產生的噪音往往使得傳統語音識別技術難以發揮效用。廣州
    的頭像 發表于 10-30 09:17 ?383次閱讀
    廣州唯創電子WTK6900H-32N<b class='flag-5'>語音</b><b class='flag-5'>識別</b>芯片:AI降噪算法助力抽油煙機精準<b class='flag-5'>語音</b>控制 | <b class='flag-5'>語音</b>IC廠家

    語音識別系統的技術核心:從聲音到文字的智能轉換

    ? ? ? 語音識別技術,也稱為自動語音識別(ASR),其核心目標是將人類語音信號轉換為對應的文
    的頭像 發表于 09-05 14:04 ?839次閱讀

    瑞芯微RK3576語音識別算法

    1.語音識別簡介語音識別技術,也被稱為自動語音識別
    的頭像 發表于 08-15 15:13 ?2188次閱讀
    瑞芯微RK3576<b class='flag-5'>語音</b><b class='flag-5'>識別</b>算法

    語音識別---大家怎么看呢?

    語音識別是一門交叉學科。近二十年來,語音識別技術取得顯著進步,開始從實驗室走向市場。人們預計,未來10年內,
    發表于 08-09 10:54

    語音識別芯片選型有哪些技術參數要注意

    語音識別芯片的使用場景越來越多涉及的范圍也越來越廣!那么語音芯片的選型就很重要了,選型不對直接影響產品的使用體驗,下面小編從不同的維度來給大家介紹語音
    的頭像 發表于 06-23 17:31 ?875次閱讀
    <b class='flag-5'>語音</b><b class='flag-5'>識別</b>芯片選型有哪些<b class='flag-5'>技術</b>參數要注意

    明遠智睿SSD2351開發板:語音機器人領域的變革力量

    源的開發資料為開發者提供了深入研究和定制語音機器人功能的基礎,開發者可以根據不同的應用需求,對語音識別算法、語音合成引擎等進行優化和改進。一對一的
    發表于 05-28 11:36

    普強信息入選2024語音識別技術公司TOP30榜單

    普強憑借在語音識別領域多年的技術積淀與持續的創新突破,成功入選“2024語音識別技術公司TOP3
    的頭像 發表于 04-18 17:25 ?1212次閱讀

    半導體材料發展史:從硅基到超寬禁帶半導體的跨越

    半導體材料是現代信息技術的基石,其發展史不僅是科技進步的縮影,更是人類對材料性能極限不斷突破的見證。從第一代硅基材料到第四代超寬禁帶半導體,每一代材料的迭代都推動了電子器件性能的飛躍。 1 第一代
    的頭像 發表于 04-10 15:58 ?3188次閱讀

    廠家芯資訊|廣州唯創電子語音識別芯片技術解析

    ?一、公司及產品概述作為國內領先的語音芯片研發企業,深耕語音技術領域25年,其產品以高穩定性、低功耗和多場景適應性著稱。公司推出的語音識別
    的頭像 發表于 03-19 08:46 ?804次閱讀
    廠家芯資訊|廣州唯創電子<b class='flag-5'>語音</b><b class='flag-5'>識別</b>芯片<b class='flag-5'>技術</b>解析