参数调优 约 4 分钟
音频文件太大:码率与声道的减法
一段两小时的课程录音 200MB,平台限 50MB——音频的体积减法比视频简单得多,关键是按损失从小到大的顺序动刀。
第一刀:降码率(损失最小)
码率是音频体积的直接决定因素,而"够用码率"远比多数人以为的低:纯语音(课程、访谈、会议)64kbps 足够清晰,有声书 48kbps 也能听;音乐类素材底线高一些,128kbps 是通用档,160kbps 覆盖大多数听感挑剔的场景。
先确认内容类型再选码率:语音类直接砍到 64,体积立减一半以上,听感几乎无差。最常见的浪费是"语音内容用了 192kbps"——多出来的码率全部花在了根本不存在的频率细节上。
第二刀:声道减半(语音专属)
立体声用两个声道承载左右差异,但语音内容几乎没有立体声信息——两个人的对话、一个人的课程,单声道完全不损失内容。转单声道后同等总码率下每个声道的有效数据翻倍,等于"体积不变、清晰度提升",或者"清晰度不变、码率再砍一半"。
只有音乐(尤其是编曲宽、有左右声像设计的)需要保留立体声。判断方法:戴上耳机听几秒,左右耳内容明显不同的保留立体声,几乎一样的转单声道。
第三刀:换容器与验收
前两刀还不达标再考虑换格式:M4A(AAC)在同码率下比 MP3 听感更好,体积相近;无损格式(WAV/FLAC)除非要进剪辑软件二次加工,否则存档场景也该转成有损。三轮减法下来,200MB 的语音课能压到 60MB 以内。
压完验收三处:开头十秒(最容易出现编码爆音)、声音最响的段落(检查削波)、安静段落(检查底噪是否被码率放大)。任何一处异常就回调一档码率重压。