如何从任何歌曲中分离音轨
什么是音轨分离?
音轨分离(也称为声源分离)会从完成的立体声混音中估算出人声、鼓、贝斯和其他乐器。得到的四条 stem 可以分别试听、静音、独奏和调整音量,适合制作伴奏、练习曲目、混搭草稿或采样素材。
Echo 的音轨分离器使用 HTDemucs 在浏览器中完成四路分离。它不是简单地削减某个频率范围,而是尝试识别混音中相互重叠的声源;分离效果会随编曲、混响、失真和源文件质量而变化。
如何使用 Echo 的浏览器工具分离音轨
在桌面浏览器中打开 voicechanger.live/tools/stem-splitter,选择一段最长 10 分钟、最大 200 MB 的音频。浏览器能否打开某种格式取决于它自己的音频解码能力,因此开始前请以页面的文件检查结果为准。
首次使用时,浏览器会直接下载、校验并缓存约 172 MB 的 HTDemucs 模型和所需运行时。所选歌曲留在设备上,不会发送到分离服务器;但正常页面代码、模型和运行时仍需从外部主机加载。支持时使用 WebGPU,否则在本机回退到 WASM。处理速度取决于歌曲长度、浏览器和电脑性能。
分离完成后,可以在同一时间位置对照原音与四条 stem,静音、独奏或调整各轨音量。你可以下载单独的 WAV、包含全部音轨的 ZIP,或把当前音量组合下载为自定义 WAV 混音。
Stems 和多轨录音有什么区别?
多轨录音是录音或制作工程中的原始独立轨道,可能包含多个麦克风、叠录、效果返回和自动化。Stems 通常是把这些轨道合并成较大的乐器组,例如全部鼓组或全部人声。
从成品歌曲中分离出的 stems 是模型对这些乐器组的估算,并不是原始多轨录音的还原。它们更容易从现有歌曲中获得,但可能保留串音或出现处理瑕疵。
两路人声分离还是四路音轨分离?
如果只想得到人声和伴奏,请使用单独的人声分离器。它采用 UVR-MDX 两路模型,页面和结果流程都针对人声与伴奏设计。
如果需要分别控制人声、鼓、贝斯和其他乐器,请使用这款四路音轨分离器。两款工具使用不同模型;不要把两路结果当作四路结果中的同一种处理模式。
如何判断串音和分离瑕疵
串音是某件乐器仍能在另一条 stem 中听见;处理瑕疵则可能表现为金属感、颤动、断裂的瞬态或不自然的混响尾音。密集编曲、共享频率、失真和重混响通常更难分离。
先在同一时间位置切换原音和混音,再独奏每条 stem,重点听鼓点瞬态、人声齿音、贝斯低频和混响尾音。更高质量的源文件通常能提供更多可用细节,但任何输入都不能保证完全干净。
制作人、DJ、音乐人和卡拉 OK 的用法
制作人可以用分轨做编曲参考、快速混音草稿或在 DAW 中测试新的平衡;DJ 可以先试听人声与伴奏的搭配;音乐人可以静音某件乐器后跟着其余乐队练习。
卡拉 OK 用户可以降低或静音人声,采样创作者可以寻找鼓点、贝斯线或乐句。公开发布、演出、采样或商业使用前,请先确认你有权使用原录音和分离出的内容。
分离音轨时需要哪些权利?
技术上能够分离歌曲并不代表自动获得使用许可。版权、录音制品权、作曲权和平台规则会因作品、地区和用途而异。
处理自己的录音或已获明确许可的素材最稳妥。若要发布混音、发行采样、用于广告、直播存档或公开演出,请向相关权利人确认许可;不确定时应咨询合格的法律专业人士。