教學··閱讀時間 7 分鐘

如何從任何歌曲中分離音軌

什麼是音軌分離?

音軌分離(也稱為音源分離)會從完成的立體聲混音中估算出人聲、鼓組、貝斯和其他樂器。得到的四條 stem 可以分別試聽、靜音、獨奏和調整音量,適合製作伴奏、練習音軌、混搭草稿或取樣素材。

Echo 的音軌分離器使用 HTDemucs 在瀏覽器中完成四路分離。它不是單純削減某段頻率,而是嘗試辨識混音中彼此重疊的音源;分離效果會隨編曲、殘響、失真和來源檔案品質而改變。

如何使用 Echo 的瀏覽器工具分離音軌

在桌面瀏覽器中開啟 voicechanger.live/tools/stem-splitter,選擇一段最長 10 分鐘、最大 200 MB 的音訊。瀏覽器能否開啟特定格式取決於本身的音訊解碼能力,因此開始前請以頁面的檔案檢查結果為準。

第一次使用時,瀏覽器會直接下載、驗證並快取約 172 MB 的 HTDemucs 模型和必要的執行環境。選取的歌曲留在裝置上,不會送到分離伺服器;但一般頁面程式碼、模型和執行環境仍需從外部主機載入。支援時使用 WebGPU,否則在本機改用 WASM。處理速度取決於歌曲長度、瀏覽器和電腦效能。

分離完成後,可以在相同播放位置比較原音與四條 stem,並將各軌靜音、獨奏或調整音量。你可以下載個別 WAV、包含全部音軌的 ZIP,或把目前的音量組合下載成自訂 WAV 混音。

Stems 和多軌錄音有什麼不同?

多軌錄音是錄音或製作工程中的原始獨立軌道,可能包含多支麥克風、疊錄、效果回傳和自動化。Stems 通常是把這些軌道合併成較大的樂器群組,例如完整鼓組或全部人聲。

從成品歌曲分離出的 stems 是模型對這些樂器群組的估算,並不是原始多軌錄音的還原。它們比較容易從現有歌曲取得,但可能保留聲音滲漏或出現處理瑕疵。

兩路人聲分離還是四路音軌分離?

如果只想取得人聲和伴奏,請使用獨立的人聲消除器。它採用 UVR-MDX 兩路模型,頁面和結果流程都針對人聲與伴奏設計。

如果需要分別控制人聲、鼓組、貝斯和其他樂器,請使用這款四路音軌分離器。兩款工具使用不同模型;不要把兩路結果當成四路結果中的另一種處理模式。

如何判斷聲音滲漏和分離瑕疵

聲音滲漏是某件樂器仍可在另一條 stem 中聽見;處理瑕疵則可能表現為金屬感、顫動、破碎的瞬態或不自然的殘響尾音。密集編曲、共用頻率、失真和大量殘響通常更難分離。

先在相同播放位置切換原音和混音,再獨奏每條 stem,特別留意鼓點瞬態、人聲齒音、貝斯低頻和殘響尾音。較高品質的來源檔案通常能保留更多可用細節,但任何輸入都不能保證完全乾淨。

製作人、DJ、音樂人和卡拉 OK 的用法

製作人可以用分軌做編曲參考、快速混音草稿,或在 DAW 中測試新的平衡;DJ 可以先試聽人聲與伴奏的搭配;音樂人可以把某件樂器靜音,再跟著其餘樂團練習。

卡拉 OK 使用者可以降低或靜音人聲,取樣創作者可以尋找鼓點、貝斯線或樂句。公開發布、演出、取樣或商業使用前,請先確認你有權使用原始錄音和分離出的內容。

分離音軌時需要哪些權利?

技術上能夠分離歌曲,不代表自動取得使用授權。著作權、錄音著作權、詞曲權利和平台規則會因作品、地區和用途而異。

處理自己的錄音或已取得明確授權的素材最穩妥。若要發布混音、發行取樣、用於廣告、實況存檔或公開演出,請向相關權利人確認授權;不確定時應諮詢合格的法律專業人士。

常見問題

音軌分離是免費的嗎?+
是的,Echo 的瀏覽器音軌分離器可免費使用,免註冊帳號,也不必安裝桌面軟體。目前的桌面流程每次處理一個最長 10 分鐘、最大 200 MB 的檔案;實際可用性仍取決於瀏覽器和裝置資源。
AI 音軌分離的效果好嗎?+
HTDemucs 能為許多歌曲產生可用的人聲、鼓組、貝斯和其他樂器 stem,但效果取決於編曲和來源檔案。複雜混音可能出現聲音滲漏、金屬感或殘響尾音,因此重要專案應逐軌試聽。
歌曲會上傳到伺服器嗎?+
選取的歌曲留在裝置上,不會送到音軌分離伺服器。第一次使用仍需從外部主機下載約 172 MB 的模型和執行環境;瀏覽器會驗證並快取模型,供後續使用。
可以怎樣下載分離結果?+
可以分別下載人聲、鼓組、貝斯和其他樂器的 WAV,也可以下載包含全部音軌的 ZIP。調整各軌音量後,還能把目前的組合下載成自訂 WAV 混音。

Try Echo

Free AI voice conversion. Download and start in under 60 seconds.

下載 Echo