跳转到主要内容
工作流5 分钟

给视频配背景音乐:混合、替换与音量平衡

给视频配 BGM 的核心问题只有一个:音乐和原声怎么相处。保留原声做混合,还是彻底替换?人声与音乐的音量比是多少?想清楚这两件事,合成只是一步操作。

混合与替换两种模式

混合模式:原声与音乐叠加输出,适合 vlog、纪实类内容——现场声保留真实感,BGM 垫底烘托。音乐短于视频时可以开启循环,自动补满时长。

替换模式:丢弃原声,只留音乐,适合纯画面内容(延时摄影、产品展示)。原视频没有音轨时,工具自动按替换处理,无需选择。

两种模式下画面都是流复制:不重编码、无画质损失,合成速度取决于文件读写而非视频时长。

音量平衡的口径

有人声的内容:BGM 音量调到人声的 1/4 到 1/8(相对电平约 -12 到 -18dB)。工具默认音乐音量 80% 适合无人声的纯画面内容;有人声时先降到 20–30% 试听后微调。

判断标准不是看电平表,而是切换着听:关掉 BGM 听一段人声,再开 BGM 听——能毫不费力听清每句话,BGM 又始终存在,就是对的平衡。

音乐本身响度差异很大:直接从流媒体下载的曲目响度接近满幅,与原声混合前建议先把音乐文件降 6–10dB。

音乐短于视频的处理

开启循环后,音乐会无缝重复到视频结束(流循环,不产生拼接爆音)。循环点突兀的曲目,先用音频剪裁取一段首尾接近的片段再循环。

更可控的做法:用音频循环工具把音乐先扩展到目标时长,试听确认循环点后再与视频合成——一次成型,避免反复合成大视频。

多段音频的叠加

人声配音 + BGM + 音效的多轨需求超出两轨混合时,分步合成:先把人声与 BGM 用音频混合工具合成一轨,再与视频合成。

混合工具可以独立调第二轨音量:人声做主轨(100%),BGM 做第二轨(20–30%),输出即平衡好的单轨。

常见问题