数字信号处理


文档摘要

数字信号处理 数字信号处理(Digital Signal Processing,DSP)把原始音频波形转换为机器学习模型能够学习的结构化表示。本文件涵盖声音的物理原理、采样与量化、傅里叶变换(DFT、FFT)、频谱图、梅尔滤波器组、MFCC 以及加窗——这是所有语音与音频 AI 的特征提取流水线。 声音是一种通过介质(空气、水、固体)传播的压力波。一个振动的物体(声带、吉他弦、扬声器纸盆)推拉空气分子,形成交替的高压区(压缩)和低压区(稀疏)。 这些压力变化以大约 343 m/s 的速度在空气中向外传播,到达你的耳朵后使鼓膜振动,并被转换为神经信号。 可以把声音想象成把一颗石头扔进平静的池塘:石头是振动的源,涟漪是压力波,而水面上随波浮动的软木塞就是响应波到的麦克风或鼓膜。


发布者: 作者: HenryNdubuaku 转发
评论区 (0)
U