




下載本文檔
版權說明:本文檔由用戶提供并上傳,收益歸屬內容提供方,若內容存在侵權,請進行舉報或認領
文檔簡介
語音識別技術的發展與未來語音識別技術的發展與未來語音識別技術的發展與未來xxx公司語音識別技術的發展與未來文件編號:文件日期:修訂次數:第1.0次更改批準審核制定方案設計,管理制度語音識別技術的發展與未來與機器進行語音交流,讓它聽明白你在說什么。語音識別技術將人類這一曾經的夢想變成了現實。語音識別就好比“機器的聽覺系統”,該技術讓機器通過識別和理解,把語音信號轉變為相應的文本或命令。在1952年的貝爾研究所,Davis等人研制了世界上第一個能識別10個英文數字發音的實驗系統。1960年英國的Denes等人研制了第一個計算機語音識別系統。大規模的語音識別研究始于上世紀70年代以后,并在小詞匯量、孤立詞的識別方面取得了實質性的進展。上世紀80年代以后,語音識別研究的重點逐漸轉向大詞匯量、非特定人連續語音識別。同時,語音識別在研究思路上也發生了重大變化,由傳統的基于標準模板匹配的技術思路開始轉向基于統計模型的技術思路。此外,業內有專家再次提出了將神經網絡技術引入語音識別問題的技術思路。上世紀90年代以后,在語音識別的系統框架方面并沒有什么重大突破。但是,在語音識別技術的應用及產品化方面出現了很大的進展。比如,DARPA是在上世界70年代由美國國防部遠景研究計劃局資助的一項計劃,旨在支持語言理解系統的研究開發工作。進入上世紀90年代,DARPA計劃仍在持續進行中,其研究重點已轉向識別裝置中的自然語言處理部分,識別任務設定為“航空旅行信息檢索”。我國的語音識別研究起始于1958年,由中國科學院聲學所利用電子管電路識別10個元音。由于當時條件的限制,中國的語音識別研究工作一直處于緩慢發展的階段。直至1973年,中國科學院聲學所開始了計算機語音識別。進入上世紀80年代以來,隨著計算機應用技術在我國逐漸普及和應用以及數字信號技術的進一步發展,國內許多單位具備了研究語音技術的基本條件。與此同時,國際上語音識別技術在經過了多年的沉寂之后重又成為研究的熱點。在這種形式下,國內許多單位紛紛投入到這項研究工作中去。1986年,語音識別作為智能計算機系統研究的一個重要組成部分而被專門列為研究課題。在“863”計劃的支持下,中國開始組織語音識別技術的研究,并決定了每隔兩年召開一次語音識別的專題會議。自此,我國語音識別技術進入了一個新的發展階段。自2009年以來,借助機器學習領域深度學習研究的發展以及大數據語料的積累,語音識別技術得到突飛猛進的發展。將機器學習領域深度學習研究引入到語音識別聲學模型訓練,使用帶RBM預訓練的多層神經網絡,提高了聲學模型的準確率。在此方面,微軟公司的研究人員率先取得了突破性進展,他們使用深層神經網絡模型(DNN)后,語音識別錯誤率降低了30%,是近20年來語音識別技術方面最快的進步。2009年前后,大多主流的語音識別解碼器已經采用基于有限狀態機(WFST)的解碼網絡,該解碼網絡可以把語言模型、詞典和聲學共享音字集統一集成為一個大的解碼網絡,提高了解碼的速度,為語音識別的實時應用提供了基礎。隨著互聯網的快速發展,以及手機等移動終端的普及應用,可以從多個渠道獲取大量文本或語音方面的語料,這為語音識別中的語言模型和聲學模型的訓練提供了豐富的資源,使得構建通用大規模語言模型和聲學模型成為可能。在語音識別中,訓練數據的匹配和豐富性是推動系統性能提升的最重要因素之一,但是語料的標注和分析需要長期的積累和沉淀,隨著大數據時代的來臨,大規模語料資源的積累將提到戰略高度。現如今,語音識別在移動終端上的應用最為火熱,語音對話機器人、語音助手、互動工具等層出不窮,許多互聯網公司紛紛投入人力、物力和財力展開此方面的研究和應用,目的是通過語音交互的新穎和便利模式迅速占領客戶群。(雨田整理)相關產品siriSiri技術來源于美國國防部高級研究規劃局所公布的CALO計劃:一個讓軍方簡化處理一些繁復庶務,并具學習、組織以及認知能力的數字助理,其所衍生出來的民用版軟件Siri虛擬個人助理。Siri成立于2007年,最初是以文字聊天服務為主,隨后通過與語音識別廠商Nuance合作,Siri實現了語音識別功能。2010年,Siri被蘋果以2億美金收購。Siri成為蘋果公司在其產品iPhone和iPadAir上應用的一項語音控制功能。Siri可以令iPhone和iPadAir變身為一臺智能化機器人。Siri支持自然語言輸入,并且可以調用系統自帶的天氣預報、日程安排、搜索資料等應用,還能夠不斷學習新的聲音和語調,提供對話式的應答。GoogleNowGoogleNow是谷歌隨安卓系統同時推出的一款應用,它可以了解用戶的各種習慣和正在進行的動作,并利用所了解的資料來為用戶提供相關信息。今年3月24日,谷歌宣布GoogleNow語音服務正式登陸Windows和Mac桌面版Chrome瀏覽器。GoogleNow的應用會更加方便用戶收取電子郵件,當你接收到新郵件時,它就會自動彈出以便你查看。GoogleNow還推出了步行和行車里程記錄功能,這個計步器功能可通過Android設備的傳感器來統計用戶每月行駛的里程,包括步行和騎自行車的路程。此外,GoogleNow增加了一些旅游和娛樂特色功能,包括:汽車租賃、演唱會門票和通勤共享方面的卡片;公共交通和電視節目的卡片進行改善,這些卡片現在可以聽音識別音樂和節目信息;用戶可以為新媒體節目的開播設定搜索提醒,同時還可以接收實時NCAA(美國大學體育協會)橄欖球比分。百度語音百度語音一般指百度語音搜索,是百度公司為廣大互聯網用戶提供的一種基于語音的搜索服務,用戶可以使用多種客戶端發起語音搜索,服務器端根據用戶的發出的語音請求,進行語音識別然后將檢索結果反饋給用戶。百度語音搜索不僅提供一般的通用語音搜索服務,還有針對地圖用戶制定的特色搜索服務,后續還會有更多的個性化搜索和識別服務出現。目前百度語音搜索以移動客戶端為主要平臺,內嵌于百度的其他產品中,比如掌上百度,百度手機地圖等,用戶可以在使用這些客戶端產品的同時體驗語音搜索,支持全部主流的手機操作系統。微軟CortanaCortana是WindowsPhone平臺下的虛擬語音助手,由游戲《光暈》中Cortana的聲優JenTaylor配音,Cortana中文版又名“微軟小娜”。微軟對Cortana的描述為“你手機上的私人助手,為你提供設置日歷項、建議、進程等更多幫助”,它能夠和你之間進行交互,并且盡可能的模擬
溫馨提示
- 1. 本站所有資源如無特殊說明,都需要本地電腦安裝OFFICE2007和PDF閱讀器。圖紙軟件為CAD,CAXA,PROE,UG,SolidWorks等.壓縮文件請下載最新的WinRAR軟件解壓。
- 2. 本站的文檔不包含任何第三方提供的附件圖紙等,如果需要附件,請聯系上傳者。文件的所有權益歸上傳用戶所有。
- 3. 本站RAR壓縮包中若帶圖紙,網頁內容里面會有圖紙預覽,若沒有圖紙預覽就沒有圖紙。
- 4. 未經權益所有人同意不得將文件中的內容挪作商業或盈利用途。
- 5. 人人文庫網僅提供信息存儲空間,僅對用戶上傳內容的表現方式做保護處理,對用戶上傳分享的文檔內容本身不做任何修改或編輯,并不能對任何下載內容負責。
- 6. 下載文件中如有侵權或不適當內容,請與我們聯系,我們立即糾正。
- 7. 本站不保證下載資源的準確性、安全性和完整性, 同時也不承擔用戶因使用這些下載資源對自己和他人造成任何形式的傷害或損失。
最新文檔
- 遼寧地質工程職業學院《平法設計與施工規則》2023-2024學年第一學期期末試卷
- 上海市同濟大附屬存志校2025年初三畢業班第一次質量檢測試題物理試題模擬試題含解析
- 華東交通大學《空間數據挖掘與知識發現》2023-2024學年第二學期期末試卷
- 三江學院《德語會話》2023-2024學年第一學期期末試卷
- 重慶科技職業學院《移動開發》2023-2024學年第二學期期末試卷
- 貴州城市職業學院《航海氣象學與海洋學》2023-2024學年第一學期期末試卷
- 云南省文山市重點中學2025年高三下學期第二次質檢物理試題理試題含解析
- 2024年陜西寶雞市新華書店有限責任公司公開招聘員工23人筆試參考題庫附帶答案詳解
- 荊州學院《藝術展覽策劃》2023-2024學年第一學期期末試卷
- 2024年北京銷售分公司秋季高校畢業生招聘15人筆試參考題庫附帶答案詳解
- 小學創建“五好”學校關工委實施方案
- 2025屆河南省五市高三第一次聯考生物試題(原卷版+解析版)
- 2025年安徽九華山旅游發展股份有限公司招聘66人筆試參考題庫附帶答案詳解
- 統編版2024~2025學年度六年級語文第二學期期中測試卷(有答案)
- 排水運維技巧培訓課件
- 多發性硬化課件
- 2019全國中學生生物學聯賽試題詳解
- 2025年職業指導師專業能力測試卷:職業心理健康與心理測評試題
- 安徽省蚌埠市2024-2025學年高三(下)第二次質檢物理試卷(含解析)
- 2024年中國農業銀行系統招聘筆試考試題庫(濃縮500題)
- 2025年日歷表(A4版含農歷可編輯)
評論
0/150
提交評論