Hey Siri及Ok Google原理：AI語音辨識專案真應用開發

当前位置: 首页 > 电脑资讯 > 概论/科技趋势 > Hey Siri及Ok Google原理：AI語音辨識專案真應用開發

详细介绍商品属性商品标记

內容簡介

☆★☆★【語音辨識專案應用開發！】★☆★☆
了解語音辨識概要，讓你對WebRTC及Kaldi瞭若指掌！

　　隨著AI時代的來臨，人類語言的處理在硬體高度平民化之後，你我也可以開發出類似的產品，事實上語音服務早在1950年代就開始研究了。這些應用早就存在於智慧喇叭、手機語音助理、車載智慧座艙、語音輸入法與翻譯機等；企業級應用包括智慧客服、語音品管、智慧教育、智慧醫療等。本書是難得少見的中文語音高階技術的教材，用簡單的Kaldi、WebRTC、gRPC等專案，就可以開發出企業等級的語音服務應用，這些下放至平民百姓家的技術，在搭配本書之後，立即成為你可以立刻上手的工具，充份應用人工智慧時代深度學習技術帶來的福利。

本書特色

　　✪語音前端處理，語音辨識
　　✪語者自動分段標記演算法原理
　　✪基於WebRTC，Kaldi和gRPC，從零建構穩定、高性能、可商用的語音服務
　　✪前端演算法完整介紹
　　✪語音活動檢測、語音降噪、回聲消除、波束形成
　　✪WebRTC和Kaldi最佳化處理流程
　　✪形成語音演算法SDK
　　✪微服務建構的RPC遠端呼叫框架和SDK

作者介紹

作者簡介

楊學銳

　　大疆創新語音交互演算法負責人，復旦大學及Turku大學碩士，長期從事語音演算法、深度學習、人工智慧等領域的研究與商業落地，在相關領域發表多篇論文及專利。

晏超

　　北京郵電大學碩士，曾任職於HP Labs， Cisco， Technicolor等公司。現為雲從科技語音演算法負責人，從事語音辨識、聲紋識別、說話人日誌、語音合成等方向的演算法研發工作，構建了雲從科技整套語音演算法引擎與應用服務平臺。

劉雪松

　　OPPO音訊演算法專家，復旦大學碩士，曾任職於美國國家儀器、聲網、雲從科技等公司。在信號處理、音訊演算法和語音演算法等領域有豐富的實戰經驗，在相關領域發表多篇論文及專利。

Chapter 01 語音辨識概述
1.1 語音辨識發展歷程
1.2 語音辨識產業與應用
1.3 常用語音處理工具

Chapter 02 語音訊號基礎
2.1 語音訊號的聲學基礎
2.2 語音訊號的數位化和時頻變換
2.3 本章小結

Chapter 03 語音前端演算法
3.1 語音前端演算法概述
3.2 VAD
3.3 單通道降噪
3.4 回音消除
3.5 麥克風陣列與波束形成
3.6 聲源定位
3.7 其他未盡話題
3.8 本章小結

Chapter 04 語音辨識原理
4.1 特徵提取
4.2 傳統聲學模型
4.3 DNN-HMM
4.4 語言模型
4.5 WFST 解碼器
4.6 序列區分性訓練
4.7 點對點語音辨識
4.8 語音辨識模型評估
4.9 本章小結

Chapter 05 中文漢語模型訓練-- 以multi_cn 為例
5.1 Kaldi 安裝與環境設定
5.2 Kaldi 中的資料格式與資料準備
5.3 語言模型訓練
5.4 發音詞典準備
5.5 特徵提取
5.6 Kaldi 中的Transition 模型
5.7 預對齊模型訓練
5.8 資料增強
5.9 I-Vector 訓練
5.10 神經網路訓練
5.11 解碼圖生成
5.12 本章小結
5.13 附錄

Chapter 06 基於Kaldi 的語者自動分段標記
6.1 語者自動分段標記概述
6.2 聲紋模型訓練-- 以CNCeleb 為例
6.3 本章小結

Chapter 07 基於Kaldi 的語音SDK 實現
7.1 語音特徵提取
7.2 基於WebRTC 的語音活動檢測
7.3 語者自動分段標記模組
7.4 語音辨識解碼
7.5 本章小結

Chapter 08 基於gRPC 的語音辨識服務
8.1 gRPC 語音服務
8.2 ProtoBuf 協定定義
8.3 基於gRPC 的語音服務實現
8.4 本章小結

Appendix A 參考文獻

Hey Siri及Ok Google原理：AI語音辨識專案真應用開發


作者：	楊學銳,晏超,劉雪松
出版社：	深智數位
出版日期：	2022-09-20
商品库存：	点击查询库存
	以上库存为海外库存属流动性。可选择“空运”或“海运”配送，空运费每件商品是RM14。配送时间：空运约8~12个工作天，海运约30个工作天。（以上预计配送时间不包括出版社库存不足需调货及尚未出版的新品）
定价：	NT880.00
市场价格：	RM133.87
本店售价：	RM119.14

购买数量：

	??論/科技趨勢
作者	楊學銳,晏超,劉雪松
出版社	深智數位
ISBN	9786267146484
出版日期	2022-09-20
开本
页数	464
装帧	平裝
规格	23 / 單色印刷 / 普級
版次	初版
版本（简/繁）

有店 App

当前分类

浏览历史

Hey Siri及Ok Google原理：AI語音辨識專案真應用開發