第 2 章 声学侧:把声音炼成特征 章节摘要:这一章是流水间的第一台主力工位带,它回答一个问题:一段一段的原始声音,凭什么能被机器判断"处在什么音素"。答案是裁判看不懂波形,却看得懂数字特征。本章从声学模型的本职说起,带着你走完"波形到帧、帧到特征、特征到音素状态"的整条声学路线,再讲清传统与深度两代声学模型怎么在这条路上各自发力、又各有什么毛病。 学习目标 能说清声学模型的标准输入输出,并讲出它对"每帧特征到音素状态概率"的建模方式。 会员。《第 2 章 声学侧:把声音炼成特征》收录于灏天文库文集《语音识别技术基础:声学模型与语言模型》,原作者/来源:灏天文库,整理自「灏天文库」,提供技术教程、实践指南与问题解决方案,支持在线阅读、全文检索与知识沉淀,助力开发者系统化学习。本站整理收录,版权归原作者/开源协议所有。