2.4 语音建模单元 声学模型对"谁"打分,取决于我们定义的建模单元。一层比词粗音素,但音素在不同邻居面前会变声;于是有了考虑上下文的三音素,实际落地时还会加上前后各少许边界状态。这一节围绕"单元选多大"讲透三个层次:音素、三音素、HMM 状态,以及状态绑定如何在数据不充裕的角落救场。 学习目标 能说明为什么"用音素做单元"比"用词做单元"更划算。 能解释三音素如何建模上下文依赖,并给出正反两面的代价。 会员。《2.4 语音建模单元》收录于灏天文库文集《语音识别技术基础:声学模型与语言模型》,原作者/来源:灏天文库,整理自「灏天文库」,提供技术教程、实践指南与问题解决方案,支持在线阅读、全文检索与知识沉淀,助力开发者系统化学习。本站整理收录,版权归原作者/开源协议所有。