如何从歌曲中去掉人声
常见问题
- 任何歌曲都能去掉人声吗?
- 可以。WaveCraft 会从任意音轨中分离主唱人声,输出两个文件:人声和伴奏。整个过程在设备上完成,断网也能用,你的音频不会被上传。
- 去掉人声会破坏歌曲的其余部分吗?
- 不会,前提是工具采用重建而不是相减。用一路声道去减另一路,同样会减掉底鼓、贝斯和人声本身。WaveCraft 估计人声掩码后重建两个信号,伴奏因此得以保留。
- 人声加伴奏能还原成原曲吗?
- 能,精确到每一个采样点。分离是互补的,人声加伴奏等于原混音,没有任何能量被悄悄丢弃,因此你可以把伴奏叠在任何素材下面,需要时再相加还原。
- 分出来的人声会比原来录的更干净吗?
- 不会。分离出的人声是对同一次演奏的重建,节奏和录音一模一样。它不是重新录制,无法优于原始录音。
简短答案
把歌曲导入 WaveCraft,运行人声分离,你会得到两个文件:人声和伴奏。伴奏就是卡拉OK/纯音乐版本,人声文件则是清唱。处理全程在手机本地完成——音频不会离开你的设备,没信号也能用。
「去人声」到底在做什么
这件事有两种做法,难度天差地别:
真正的分离(本文的做法)。 神经网络听完整首混音,估计一个人声掩码——也就是「这一瞬间、这个频率上有多少是人声」的估计值——再据此重建两个信号。对现代商业混音有效。
声道相减(多数廉价做法的本质)。 假定人声正好在正中间,然后一路声道减另一路。这招只在很老的、把人声严格放在中央的立体声录音上有效,会连带清空所有处在中间的东西:底鼓、贝斯,以及人声本身。
如果你试过声道相减,得到的是一个空洞、带回声、贝斯也没了的结果,那不是参数没调对。这个方法本身就保不住它要抵消掉的东西。分离模型是做重建,不是做减法,所以它能扛住现代混音。
怎么操作
- 打开 WaveCraft,新建工程。
- 导入要处理的音轨。
- 选中音轨,在处理菜单里选择分离人声。
- 等待这一遍处理完成。时间线上会出现两条音轨。
- 静音或独奏你需要的那条——要伴奏就静音人声,要改编或练唱就独奏人声。
如果素材是视频,可以直接导入视频——WaveCraft 会先从视频里提取出干净的音轨,再做分离。
分离之后,什么保住了、什么没有
分离本质是估计,所以效果取决于素材质量。实话实说:
效果好的: 主唱清晰、混响适中;密度的商业流行母带;大多数录音棚录音;人声明显浮在混音之上的素材。
更难的: 重度失真或嘶吼式演唱;多个人声交叠的密集混音;人声和乐器挤在同一频段的极限压缩母带。
你不可能得到另一条录音。 分出来的人声是重建,节奏和咬字都跟原来一致,不会比原始录音更干净——它是同一次演奏,只是去掉了其他乐器。
为什么两个输出相加等于原曲
如果你打算同时用到两个文件,这一点很关键:WaveCraft 的分离是采样级互补的。人声加伴奏能精确还原原始混音,没有任何内容被悄悄丢弃,所以你可以把伴奏叠到任何东西下面,相加就能还原原曲。
值得知道,是因为这意味着分离是可逆的,不是破坏性的。很多工具在重建时会丢能量;如果导出两条 stem 后发现混音比原来单薄,那是工具的问题,不是你的工程。
一个正当且好用的用途
分离也能用来给一首你正在学的歌做纯人声练习曲:把伴奏降到一半速度,自己录一遍,对比节奏——当其他声部不再和主唱争夺你的注意力时,这件事会容易得多。
在哪里做
WaveCraft 的分离在设备端运行,断网、飞机上、地铁里都能用,你的音频从不上传服务器。导出支持 WAV、AAC、ALAC 和 FLAC,最高 32 位浮点,stem 可以直接拖进任何 DAW 或剪辑软件,不需要二次转码。