6.5 音频编码规格(Audio Codec Specification)
视频编码的四环故事讲完了,轮到音频。如果说视频压缩的关键词是 "冗余",那么音频压缩的关键词是 "感知"——声音信号的统计特性当然也可利用,但真正让音频编码实现数量级压缩的,是对 人耳听觉局限 的系统利用。
这条战线的思想源头,我们在第一章就已埋下:1.4.3 的等响曲线告诉我们,人耳对不同频率的灵敏度天差地别。本节将把这个洞察推进为完整的编码方法论:
- 6.5.1 心理声学:音频压缩的地基:掩蔽效应——强音如何为弱音 "撑伞",量化噪声如何藏在伞下
- 6.5.2 MP3:开启数字音乐时代:子带滤波 + MDCT 的混合架构,第一套成熟的心理声学编码
- 6.5.3 AAC:青出于蓝:纯 MDCT、TNS 与 SBR/PS 带宽扩展
- 6.5.4 Opus:为实时互动而生:SILK + CELT 的混合架构,毫秒级延迟的现代规格
完成本节后,音视频两条编码进化线就全部收拢了——接下来该动手实测:practice_7 在等着我们。