如何從任何歌曲中分離音軌
什麼是音軌分離?
音軌分離(也稱為音源分離)會從完成的立體聲混音中估算出人聲、鼓組、貝斯和其他樂器。得到的四條 stem 可以分別試聽、靜音、獨奏和調整音量,適合製作伴奏、練習音軌、混搭草稿或取樣素材。
Echo 的音軌分離器使用 HTDemucs 在瀏覽器中完成四路分離。它不是單純削減某段頻率,而是嘗試辨識混音中彼此重疊的音源;分離效果會隨編曲、殘響、失真和來源檔案品質而改變。
如何使用 Echo 的瀏覽器工具分離音軌
在桌面瀏覽器中開啟 voicechanger.live/tools/stem-splitter,選擇一段最長 10 分鐘、最大 200 MB 的音訊。瀏覽器能否開啟特定格式取決於本身的音訊解碼能力,因此開始前請以頁面的檔案檢查結果為準。
第一次使用時,瀏覽器會直接下載、驗證並快取約 172 MB 的 HTDemucs 模型和必要的執行環境。選取的歌曲留在裝置上,不會送到分離伺服器;但一般頁面程式碼、模型和執行環境仍需從外部主機載入。支援時使用 WebGPU,否則在本機改用 WASM。處理速度取決於歌曲長度、瀏覽器和電腦效能。
分離完成後,可以在相同播放位置比較原音與四條 stem,並將各軌靜音、獨奏或調整音量。你可以下載個別 WAV、包含全部音軌的 ZIP,或把目前的音量組合下載成自訂 WAV 混音。
Stems 和多軌錄音有什麼不同?
多軌錄音是錄音或製作工程中的原始獨立軌道,可能包含多支麥克風、疊錄、效果回傳和自動化。Stems 通常是把這些軌道合併成較大的樂器群組,例如完整鼓組或全部人聲。
從成品歌曲分離出的 stems 是模型對這些樂器群組的估算,並不是原始多軌錄音的還原。它們比較容易從現有歌曲取得,但可能保留聲音滲漏或出現處理瑕疵。
兩路人聲分離還是四路音軌分離?
如果只想取得人聲和伴奏,請使用獨立的人聲消除器。它採用 UVR-MDX 兩路模型,頁面和結果流程都針對人聲與伴奏設計。
如果需要分別控制人聲、鼓組、貝斯和其他樂器,請使用這款四路音軌分離器。兩款工具使用不同模型;不要把兩路結果當成四路結果中的另一種處理模式。
如何判斷聲音滲漏和分離瑕疵
聲音滲漏是某件樂器仍可在另一條 stem 中聽見;處理瑕疵則可能表現為金屬感、顫動、破碎的瞬態或不自然的殘響尾音。密集編曲、共用頻率、失真和大量殘響通常更難分離。
先在相同播放位置切換原音和混音,再獨奏每條 stem,特別留意鼓點瞬態、人聲齒音、貝斯低頻和殘響尾音。較高品質的來源檔案通常能保留更多可用細節,但任何輸入都不能保證完全乾淨。
製作人、DJ、音樂人和卡拉 OK 的用法
製作人可以用分軌做編曲參考、快速混音草稿,或在 DAW 中測試新的平衡;DJ 可以先試聽人聲與伴奏的搭配;音樂人可以把某件樂器靜音,再跟著其餘樂團練習。
卡拉 OK 使用者可以降低或靜音人聲,取樣創作者可以尋找鼓點、貝斯線或樂句。公開發布、演出、取樣或商業使用前,請先確認你有權使用原始錄音和分離出的內容。
分離音軌時需要哪些權利?
技術上能夠分離歌曲,不代表自動取得使用授權。著作權、錄音著作權、詞曲權利和平台規則會因作品、地區和用途而異。
處理自己的錄音或已取得明確授權的素材最穩妥。若要發布混音、發行取樣、用於廣告、實況存檔或公開演出,請向相關權利人確認授權;不確定時應諮詢合格的法律專業人士。