本书的讲授,了解语音领域的主要研究任务及其研究主流方法,包括语音识别、语音增强、说话人识别、语音合成等任务。本书理论体系完善,涉及了主流语音处理研究方向,紧密结合当前人工智能技术发展成果,结合深度学习发展进程,了解语音处理与深度学习的交叉融合研究。本书有助于提升高校学生课程的全面程度、拓阔学生视野、增大学生的就业面,同
本书分为四个部分,层层递进地带领读者走进智能音频的世界。第一部分为基础篇,系统介绍了智能音频的概念、发展历程及其主要应用场景,同时涵盖了声音科学的基本原理和音频文件格式等内容,为后续学习打下坚实基础。第二部分为工具篇,重点讲解了如何利用AI音频工具进行声音修复、语音生成和音乐创作,通过丰富的实践案例让读者快速掌握这些工
全书共10章,内容包括:绪论、语音产生与听觉感知、语音信号特征、常用建模算法、语音编码和质量评估、语音识别、说话人识别、语音合成、语音增强、语音分离。
本书系统地介绍了语音识别在大模型时代的新技术与新应用。全书共16章,原理部分涵盖声学特征、隐马尔可夫模型(HMM)、高斯混合模型(GMM)、深度神经网络(DNN)、语言模型和加权有限状态转换器(WFST)、语音大模型,重点描述了GMM-HMM、DNN-HMM和端到端(E2E)三种语音识别框架;应用部分包含Kaldi、W
本书系统地阐述语音信号处理的原理、方法、技术和应用,同时给出部分内容对应的MATLAB程序。全书共14章,第1~7章是基本理论部分,包括绪论、语音信号的数字模型、语音信号短时时域分析、语音信号短时频域分析、语音信号倒谱分析、语音信号线性预测分析和矢量量化;第8~14章是应用部分,包括语音编码原理及应用、语音识别原理及应
全书共分11章,主要介绍了声学基础知识、音频信号的数字化、数字音频压缩编码的基本原理及相关标准、信道编码与调制技术、光盘存储技术、电子乐器数字接口(MIDI)、数字音频文件格式、音频处理与控制设备、数字音频工作站、数字声音广播、音频测量与分析等内容。每章都附有小结与习题,以指导读者加深对本书主要内容的理解。本书可作为高
本书介绍了语音信号处理的基础、原理、方法和应用,以及该学科领域近年来取得的一些新的研究成果和技术。全书共分13章,内容包括:绪论、语音信号处理的基础知识、语音信号处理的常用算法、语音信号分析、语音信号特征提取技术、语音增强、语音识别、说话人识别、语音编码、语音合成与转换、语音信号情感处理、声源定位、多模态语音信号处理。
本教材紧密结合《数字音效》课程设计,以声音概念为理论基础、人种志方法论为研究方法,结合Audition声音编辑软件,以保护声音文化遗产为目标,结合声音研究实践案例,最终实现把数字音效教材与交互媒体专业课程结合。该课程将理论课与实践作业相结合,以更直接的方式接触和理解声音、空间和材质,使学生能够运用这些知识进行个人创作。
本书系统介绍了声音信号处理的背景知识、发展历史以及研究现状与趋势,并详细阐述了基础原理、处理方法、实践应用、新成果与新技术。全书共9章。第1章绪论,第2章声音信号简介,第3章短时时域处理技术,第4章短时傅里叶变换,第5章声音信号的线性预测,第6章语音编码,第7章声音合成与转换,第8章语音识别,第9章基于深度学习技术的声
《视频师:深入学习视音频编辑(EDIUS实战版)》通过14个经典案例,深入介绍了EDIUSX的核心视频与音频编辑功能,随书赠送360多个案例素材与效果、170多分钟的同步教学视频,帮助读者逐步精通EDIUS软件,从新手成为短视频剪辑高手!14个视音频编辑案例,类型包括美景宣传、门店宣传、儿童相册、节日影像、旅行图集、延
平台介绍|荣誉资质|联系我们|出版社登陆