跳到主要內容

【2026 最新】StemDeck 教學:本機拆 6 軌、做伴奏與音質驗收

最後更新: ·
StemDeck 教學首圖:本機 AI 拆 6 軌、做伴奏與音質驗收

StemDeck 教學最容易被誤解的地方,是把「介面很好用」直接等同「分離模型很新」。2026 年 8 月 29 日的 Hacker News 發布討論吸引不少讀者追問:它是不是新的 AI 模型、CPU 跑不跑得動,以及殘音能不能放進真正的伴奏。

這篇從零開始,但不把「按下 Split stems」當終點。你會先選對 Windows/macOS/Linux 安裝包,用一段自己創作或已取得處理許可的 30 秒音檔拆出 vocals、drums、bass、guitar、piano、other,再匯出 karaoke 與 bassless mix;最後用同一時間點、等音量、盲式 A/B 檢查 bleed、瞬態破損與水波/金屬質地。想沿著音樂創作線繼續探索,也可先收藏 AlphaLab 的 AI 創作與設計專區。

先說結論:StemDeck 教學要完成的是可驗收伴奏

  • 本文鎖定正式通道 v0.15.2。截至 2026 年 8 月 31 日查核,GitHub 將它標為 Latest;v0.16.0 雖較新,仍標為 Pre-release,因此不把預發功能混進核心流程。
  • StemDeck 不是全新分離模型。預設六軌核心使用 Demucs 的 htdemucs_6s;它的價值是把匯入、波形、Mute/Solo、loop 與 Export Mix 組成一個本機工作台。
  • Auto 會為下一個工作選擇可用裝置。它依 CUDA、MPS、CPU 的順序檢查;若 GPU 工作失敗,程式可從頭改以 CPU 重試。完成摘要/log 記錄的 device,才是該工作的實際結果。速度依賴硬體與曲長,先跑 30 秒,不套用別人的分鐘數。
  • Standard 先篩選,Best 再決賽。程式把 Standard 設為 shifts=1、Best 設為 shifts=2;實際耗時仍受硬體與固定開銷影響。
  • 品質看成品情境,不只聽 solo stem。一條人聲軌單獨聽有瑕疵,不代表伴奏不可用;反過來,六軌重組接近原曲,也不代表每一軌沒有 bleed。

StemDeck = htdemucs_6s 分軌引擎 + 本機混音/匯出工作台。

StemDeck 是什麼?先拆開「模型」與「工作台」

StemDeck 官方專案採 Apache-2.0 開源授權。預設六軌分離的底層是 htdemucs_6s:輸入一首已混音歌曲,模型估計 vocals、drums、bass、guitar、piano、other 六個訊號。StemDeck 再把這些結果放進類 DAW 介面,提供波形、音量、Mute、Solo、loop、速度與匯出。

這個分層很重要。介面新增功能、版面變好看,不等於底層分離模型也更新。上游 Demucs v4.0.1 官方 README把六來源模型稱為 experimental,並特別提醒 piano 可能有較多 bleeding 與 artifacts。該 README 報告的 9.00/9.20 dB,是 MUSDB HQ 上四來源 HT Demucs 配置的 SDR,不是 htdemucs_6s成績,不能移植成 StemDeck 六軌品質分數。

StemDeck 官方 repo 收錄的六軌工作台示意圖,顯示多軌波形及 Export Mix
官方 repo 收錄的 StemDeck 工作台示意圖;它不是本文音質樣本,也不代表 v0.15.2 每項 UI 細節。

安裝前先選路徑:MPS、CUDA 還是 CPU?

截至 2026 年 8 月 31 日查核,正式通道是 StemDeck v0.15.2 release。請依硬體選完整包:Windows/Linux 有一般 x64 與 .NVIDIA版本;Apple Silicon 選 StemDeck-macOS-arm64.dmg,Intel Mac 選 x64。不要下載名稱含 -app的小檔,它是程式更新器用的 payload,不是可獨立執行的完整套件。

StemDeck 教學硬體路徑圖:Auto 依 CUDA、MPS、CPU 順序選擇可用裝置,GPU 失敗時可改以 CPU 重試
安裝包主要決定首次準備的 runtime,不會永久鎖死運算路徑;Settings 是下一次預計 device,完成摘要/log 才是實際結果。

Windows/Linux:有 NVIDIA 才選 NVIDIA 包

Windows 與 Linux 的 NVIDIA 包需要可用的 NVIDIA driver;首次啟動會取得相符的 CUDA components。只有 Intel、AMD 顯示核心,或不確定顯卡是否可用時,選一般 x64 包。解壓後保留整個資料夾結構,不要只拖走單一執行檔。

macOS:Apple Silicon 選 arm64,Intel 選 x64

macOS 版目前未 code-sign。依 v0.15.2 release 指示,把 app 拖到 Applications 後,如果系統顯示 app damaged,可在 Terminal 執行官方給的命令:

xattr -dr com.apple.quarantine /Applications/StemDeck.app

這條命令只應對你從官方 release 下載、路徑正確的 StemDeck.app 使用。首次設定仍需連網;實際取得或驗證的 runtime、FFmpeg、模型與 CUDA components 依平台及安裝包不同,因此「本機分離」不代表第一次打開就完全離線。想理解另一種本機音訊 AI 的硬體與版本鎖定思路,可對照 NeMo-Speech.cpp 本機語音 API 教學

StemDeck 教學第 1 步:先確認 Device 與 Quality

開啟 Settings,找到 Compute device。建議先保留 Auto:StemDeck 會依序檢查 CUDA、MPS、CPU;若 GPU 分離失敗,程式可從頭以 CPU 重試。Settings 的 currently 表示下一次分離會先嘗試的裝置;要確認某個 job 最後在哪個裝置完成,應看該 job 的 metadata/log,而不是只看 Settings。

Separation quality 先選 Standard。官方程式把 Standard 設為 shifts=1、Best 設為 shifts=2;實際 wall-clock 耗時仍依硬體與固定開銷而異。先用 Standard 找出素材和模型是否合拍,只把值得保留的候選再跑 Best,會比每首歌一開始就選 Best 更有效率。

StemDeck 教學第 2 步:準備一段能判分的 30 秒音檔

不要第一次就丟整首歌。從自己創作、公共領域、符合授權條款的 CC 素材,或已取得明確處理許可的錄音,截出同一段 30 秒。最好同時包含四種線索:

  1. 人聲有齒音、尾韻或 reverb,方便聽 ghost vocal。
  2. snare、cymbal 或撥弦有清楚 attack,方便抓瞬態 smear。
  3. bass 與 kick 重疊,或 piano 與 guitar 同時演奏,測試來源競爭。
  4. 至少一小段 dense chorus,確認 solo 時不明顯的瑕疵會不會回到 mix。

雖然 StemDeck 支援 URL 匯入,這次請用本機檔案,才能把下載、來源壓縮與分離問題拆開。YouTube 使用條款也不會因工具提供貼網址欄位,就自動授予下載、改作或散布權;購買、訂閱或私人練習同樣不等於取得這些權利。

StemDeck 教學第 3 步:拆出 6 軌並保存基線

  1. 把 30 秒檔案拖進 import bar,保留 All/六個 stem 都選取。
  2. 確認 quality 是 Standard,按 Split stems
  3. 完成後逐一 Solo vocals、drums、bass、guitar、piano、other,先標記明顯錯誤,不急著評總分。
  4. 用 Export → All Stems 保存六軌,再用 Export Mix 保存目前 mixer 組合。

這裡選「全部六軌」有一個好處:後面做 karaoke 或 bassless 時,只需 Mute 對應 lane。不要把介面裡的 Original lane 當成未經處理的來源;在抽取部分 stems 的流程中,它可能是未選 stems 的估計總和。要保留真正原檔,請自己另存一份,不依賴工作區名稱。

StemDeck 教學第 4 步:匯出 karaoke 與 bassless mix

做 karaoke/伴奏:Mute Vocals → Export Mix

先把六軌 fader 回到基線,Mute Vocals,播放最容易穿幫的 chorus。依序 Solo drums、bass、guitar、piano、other,檢查 ghost vocal 藏在哪一軌;若回到伴奏後已被樂器遮蔽,練唱可能足夠,若齒音和尾韻仍像幽靈人聲貼在中央,就不適合直接發布。只有抽取部分 stems 時才會出現 Original 互補軌。確認後選 Export Mix。

做 bassless 練習:Mute Bass → Export Mix

Mute Bass 後,不只聽「低頻有沒有變少」。如果 kick 也一起變薄,可能是部分 kick 能量 bleed 到 bass lane,也可能只是移除真正 bass 後改變低頻遮蔽。先 Solo Bass,在同一時間點確認是否聽得到 kick attack/body,再判定模型是否分錯。若要把分離後樂器進一步整理成 MIDI,可接著看 MuScriptor 音訊轉 MIDI 教學

音質驗收:Solo、伴奏、盲式 A/B 要分開判

公平比較的最低條件是:同一來源、同一 30 秒、同一開始點、同一輸出格式,而且播放前先做 level matching。較大聲常被誤認為更清楚;工具名稱也會把「我期待它比較新」偷渡進判斷。若要做正式小型損傷測試,可參考 ITU-R BS.1116-3的熟悉化、hidden reference 與受控條件原則。

StemDeck 分軌音質驗收圖:Solo 目標軌、逐一 Solo 其他軌、回到伴奏 Mix、盲式 A/B,並記錄 bleed、瞬態、金屬質地與速度
同一片段做四層驗收;能否分辨、比較偏好、是否可交付,是三個不同問題。

四個聽點:bleed、瞬態、水波/金屬質地、成品遮蔽

  • Bleed:目標軌裡混進不該出現的聲音,或其他核心 stem 還留下 ghost vocal。
  • 瞬態:snare、cymbal、撥弦的 attack 被磨平,出現 smear 或短促 chirp。
  • 水波/金屬質地:聲像飄動、變空洞,或高頻出現不自然的金屬感;這是聽感描述,不等於已定位為相位錯誤。
  • 成品遮蔽:回到伴奏 mix 後,瑕疵是否仍在真正使用音量下可聞。

為什麼不能用一次 null test 決勝?

若選 WAV,StemDeck v0.15.2 儲存的六個 Demucs stems 是 44.1 kHz、stereo、16-bit PCM。程式會逐 stem 呼叫 Demucs 4.0.1 的 clip="rescale";只有峰值越過門檻的 stem 才會被獨立衰減,因此六軌相加不保證與輸入做數位級相消。比較流程若另有增益、重採樣、失真編碼或 sample 對齊誤差,也會增加 residual。反過來,某段訊號從一軌漏到另一軌時,六軌重組仍可能接近原曲,所以 null 只能證明有差異,不能證明每軌乾淨。

Standard 不過關時,Best 值得再跑嗎?

值得,但要先設定停止條件。選 Standard 與 Best 各輸出同一片段,把檔名改成 A、B,再由另一人隨機對應;至少重複數輪。如果你只能穩定分辨兩者,還要再問「哪個較適合伴奏」,而不是自動把可分辨當成改善。Best 要求 shifts=2、Standard 為 shifts=1;實際耗時仍依硬體與固定開銷而異。若主要失敗是 piano 與其他樂器大量重疊,兩次 shifts 也不會把模型變成另一個架構。

本文不提供跨工具勝負分數。要比較 StemDeck、UVR 或雲端工具,應使用同一片段、同一輸出條件與盲式 A/B,並保留可回查的輸出檔;最可靠的做法,是把上面的 30 秒片段當成你自己的 acceptance test。

StemDeck、UVR、雲端工具怎麼選?

Ultimate Vocal Remover(UVR)提供多種架構、模型與 ensemble,適合願意調參、想做模型 A/B 的人;StemDeck 的主要六軌路徑固定使用 htdemucs_6s,另有可選主唱/和聲分拆,強項是迅速完成 mixer 與匯出。雲端服務把算力交給伺服器,通常省去 runtime 問題,但上傳、帳號、方案與限制會隨服務變動,使用前要即時查核。

StemDeck、UVR 與雲端分軌工具選擇圖,依本機六軌工作流、多模型彈性及伺服器算力比較
工具選擇先看工作流:StemDeck 快速完成伴奏,UVR 擴大模型選項,雲端服務降低本機門檻;三者都要回到同曲驗收。

本文建議新手用以下順序控制變因:StemDeck Standard 先篩選;不過關再跑 Best;若仍不過關,才把完全相同片段交給 UVR 或雲端工具。這樣比較的是工具差異,不是素材、音量或時間點差異。若你想做的是從零生成歌曲而非拆現有 mix,任務其實不同,請改讀 MiniMax Music 3 本機作曲教學

7 個常見失敗:介面能播,不代表結果可交付

  1. 把 v0.16 Pre-release 當正式版。核心教學先用 Latest v0.15.2;預發功能等修正正式發布再採用。
  2. 下載到 -app payload。回 release 的平台表選完整套件。
  3. 以為 NVIDIA 包支援所有顯卡。CUDA 是 NVIDIA 路徑;Intel/AMD 顯示核心不等於 CUDA。
  4. 只聽 solo stem。再逐一 Solo 其他核心 stems,最後回到伴奏;使用情境才決定可否交付。
  5. 沒有等音量。先 level-match,再隱藏工具名稱,避免 louder-is-better 偏誤。
  6. 把 Original lane 當原始錄音。真正來源檔另外保存,工作區 lane 只按程式語意理解。
  7. 一次換太多條件。曲段、quality、工具、格式一次只改一項,否則無法定位改善來自哪裡。

StemDeck 教學常見問題 FAQ

1. StemDeck 是新的 AI 分軌模型嗎?

不是。核心六軌來自 Demucs htdemucs_6s;StemDeck 是把分離、波形、練習與匯出組成現代介面的應用。

2. StemDeck 可以完全離線嗎?

依 v0.15.2 官方文件,本機檔案的 separation 在裝置上執行,不需上傳到 StemDeck 服務,但不能把整個生命週期說成永遠離線。首次設定、模型取得、更新、搜尋或 URL 匯入仍會連網。

3. 沒有 NVIDIA GPU 還能用嗎?

可以。Apple Silicon 可走 MPS,其他硬體可走 CPU;等待時間依硬體與素材而異,所以用 30 秒片段先量自己的基線。

4. Best 一定比 Standard 好嗎?

不保證。程式把 Best 設為 shifts=2、Standard 設為 shifts=1;實際耗時依硬體與固定開銷而異,是否更適合你的伴奏仍要同曲盲式 A/B。

5. 為什麼 piano 軌特別容易有 bleed?

這是上游模型已揭露的邊界。htdemucs_6s是後來加入 guitar 與 piano 的 experimental 六來源模型;官方的 quick testing 特別指出 piano 有較多 bleeding 與 artifacts。

6. 怎麼做去人聲 karaoke?

六軌全部分離後,Mute Vocals,再選 Export Mix。匯出前先在 dense chorus 聽 ghost vocal 與齒音殘留,不要只檢查安靜前奏。

7. 六軌加總接近原檔,就代表分離很乾淨嗎?

不代表。某段訊號可能從一個 stem 漏到另一個,六軌加總仍可接近原曲;逐 stem 的條件式 rescale、16-bit 量化,以及比較鏈中的增益、重採樣或對齊誤差,也會改變 residual。

8. StemDeck 和 UVR 應該先裝哪一個?

想快速做伴奏,先 StemDeck;想比較多模型與 ensemble,再用 UVR。兩者不是固定勝負,最終由同一 30 秒素材的交付驗收決定。

給新手的 5 個重點

  • 正式教學先用 v0.15.2 Latest,不把 v0.16 Pre-release 當穩定版。
  • 記住主錨點:StemDeck 是 htdemucs_6s加本機工作台,不是新模型。
  • 先用有權處理的 30 秒本機音檔與 Standard,確認 device、速度與明顯 artifacts。
  • 伴奏用 Mute Vocals,bassless 用 Mute Bass,兩者都從 Export Mix 匯出。
  • Solo 目標、逐一 Solo 其他核心 stems、回到 mix、盲式 A/B 四層都過,才叫可交付。

接著閱讀

左右滑動查看更多推薦

現在就選一段你有權處理的 30 秒音檔:Standard 拆六軌,Mute Vocals 匯出第一版伴奏,再請朋友把 Standard 與 Best,或 StemDeck 與 UVR 對同一素材、同一目標 stem 的輸出隨機標成 A/B;原檔保留作未隱藏的 reference。只要你能說清楚殘音出現在哪一秒、是否影響實際練習,這次 StemDeck 教學就不只「成功跑完」,而是真的做出一個可判斷的音訊成品。

ALPHALAB 社群

有問題?來 Telegram 聊

和 Terry、編輯、其他網友一起討論這篇文章。提問、分享觀點,回覆更即時。

加入 Telegram 討論

📩 訂閱 AlphaLab 電子報

每週最多三封:一封 Weekly 週報與最多兩封關鍵 Alpha Signal。

我們不會 spam,隨時可退訂。