教程··阅读时长 7 分钟

如何从任何歌曲中分离音轨

什么是音轨分离?

音轨分离(也称为声源分离)会从完成的立体声混音中估算出人声、鼓、贝斯和其他乐器。得到的四条 stem 可以分别试听、静音、独奏和调整音量,适合制作伴奏、练习曲目、混搭草稿或采样素材。

Echo 的音轨分离器使用 HTDemucs 在浏览器中完成四路分离。它不是简单地削减某个频率范围,而是尝试识别混音中相互重叠的声源;分离效果会随编曲、混响、失真和源文件质量而变化。

如何使用 Echo 的浏览器工具分离音轨

在桌面浏览器中打开 voicechanger.live/tools/stem-splitter,选择一段最长 10 分钟、最大 200 MB 的音频。浏览器能否打开某种格式取决于它自己的音频解码能力,因此开始前请以页面的文件检查结果为准。

首次使用时,浏览器会直接下载、校验并缓存约 172 MB 的 HTDemucs 模型和所需运行时。所选歌曲留在设备上,不会发送到分离服务器;但正常页面代码、模型和运行时仍需从外部主机加载。支持时使用 WebGPU,否则在本机回退到 WASM。处理速度取决于歌曲长度、浏览器和电脑性能。

分离完成后,可以在同一时间位置对照原音与四条 stem,静音、独奏或调整各轨音量。你可以下载单独的 WAV、包含全部音轨的 ZIP,或把当前音量组合下载为自定义 WAV 混音。

Stems 和多轨录音有什么区别?

多轨录音是录音或制作工程中的原始独立轨道,可能包含多个麦克风、叠录、效果返回和自动化。Stems 通常是把这些轨道合并成较大的乐器组,例如全部鼓组或全部人声。

从成品歌曲中分离出的 stems 是模型对这些乐器组的估算,并不是原始多轨录音的还原。它们更容易从现有歌曲中获得,但可能保留串音或出现处理瑕疵。

两路人声分离还是四路音轨分离?

如果只想得到人声和伴奏,请使用单独的人声分离器。它采用 UVR-MDX 两路模型,页面和结果流程都针对人声与伴奏设计。

如果需要分别控制人声、鼓、贝斯和其他乐器,请使用这款四路音轨分离器。两款工具使用不同模型;不要把两路结果当作四路结果中的同一种处理模式。

如何判断串音和分离瑕疵

串音是某件乐器仍能在另一条 stem 中听见;处理瑕疵则可能表现为金属感、颤动、断裂的瞬态或不自然的混响尾音。密集编曲、共享频率、失真和重混响通常更难分离。

先在同一时间位置切换原音和混音,再独奏每条 stem,重点听鼓点瞬态、人声齿音、贝斯低频和混响尾音。更高质量的源文件通常能提供更多可用细节,但任何输入都不能保证完全干净。

制作人、DJ、音乐人和卡拉 OK 的用法

制作人可以用分轨做编曲参考、快速混音草稿或在 DAW 中测试新的平衡;DJ 可以先试听人声与伴奏的搭配;音乐人可以静音某件乐器后跟着其余乐队练习。

卡拉 OK 用户可以降低或静音人声,采样创作者可以寻找鼓点、贝斯线或乐句。公开发布、演出、采样或商业使用前,请先确认你有权使用原录音和分离出的内容。

分离音轨时需要哪些权利?

技术上能够分离歌曲并不代表自动获得使用许可。版权、录音制品权、作曲权和平台规则会因作品、地区和用途而异。

处理自己的录音或已获明确许可的素材最稳妥。若要发布混音、发行采样、用于广告、直播存档或公开演出,请向相关权利人确认许可;不确定时应咨询合格的法律专业人士。

常见问题

音轨分离是免费的吗?+
是的,Echo 的浏览器音轨分离器可免费使用,无需注册账号或安装桌面软件。当前桌面流程每次处理一个最长 10 分钟、最大 200 MB 的文件;实际可用性还取决于浏览器和设备资源。
AI 音轨分离的效果好吗?+
HTDemucs 能为许多歌曲生成可用的人声、鼓、贝斯和其他乐器 stem,但效果取决于编曲和源文件。复杂混音可能出现串音、金属感或混响尾音,因此重要项目应逐轨试听。
歌曲会上传到服务器吗?+
所选歌曲留在设备上,不会发送到音轨分离服务器。首次使用仍需从外部主机下载约 172 MB 的模型和运行时;浏览器会校验并缓存模型,以便后续使用。
可以怎样下载分离结果?+
可以分别下载人声、鼓、贝斯和其他乐器的 WAV,也可以下载包含全部音轨的 ZIP。调整各轨音量后,还能把当前组合下载为自定义 WAV 混音。

Try Echo

Free AI voice conversion. Download and start in under 60 seconds.

下载 Echo