
第一次人聲分離只需 5 分鐘Ultimate Vocal Remover 伴奏提取上手指南【免費(fèi)下載鏈接】ultimatevocalremoverguiGUI for a Vocal Remover that uses Deep Neural Networks.項(xiàng)目地址: https://gitcode.com/GitHub_Trending/ul/ultimatevocalremoverguiUltimate Vocal Remover下文簡(jiǎn)稱 UVR是一款免費(fèi)開源的人聲分離工具它用深度神經(jīng)網(wǎng)絡(luò)從一首歌里拆出獨(dú)立的人聲軌和伴奏軌支持 WAV、FLAC、MP3 等常見格式。無論你做卡拉OK伴奏、提取人聲采樣還是處理播客里的背景音樂裝好之后選個(gè)模型點(diǎn)一下按鈕就能拿到第一條可用的分離結(jié)果。從一首歌到兩條軌道人聲分離到底在做什么先說清楚你要解決的問題。想讓副歌人聲單獨(dú)成軌、做一段沒有原唱的伴奏傳統(tǒng)辦法是手動(dòng)降噪加均衡費(fèi)時(shí)而且效果看運(yùn)氣。UVR 換了個(gè)思路神經(jīng)網(wǎng)絡(luò)直接預(yù)測(cè)出人聲和伴奏各自的波形你不需要懂任何音頻理論。整個(gè)流程只需要三樣?xùn)|西一首輸入音頻WAV 效果最穩(wěn)MP3/FLAC/OGG 也能處理非 WAV 文件依賴 FFmpeg 轉(zhuǎn)碼官方安裝包已內(nèi)置一個(gè)輸出目錄一個(gè)分離模型后面講怎么選跑完后你會(huì)得到兩個(gè)文件歌曲名_(Vocals).wav和歌曲名_(Instrumental).wav人聲與伴奏各占一條。 UVR 能做什么核心能力一覽能力怎么做在界面上的位置人聲/伴奏兩路分離選 MDX-Net 或 VR Arc 方法Choose Process Method 下拉框四軌分離人聲/鼓/貝斯/其他選 Demucs 方法v4 版本同上只導(dǎo)出人聲或只導(dǎo)出伴奏勾選對(duì)應(yīng)復(fù)選框主界面 Vocals Only / Instrumental Only先跑 30 秒試聽勾選 Sample Mode主界面 Sample Mode (30s)多模型結(jié)果合并打開 Ensemble 模式后勾選多個(gè)模型Ensemble 設(shè)置項(xiàng)降噪、去混響選 UVR-DeNoise 等專用模型Choose Model 下拉框音高/時(shí)間拉伸依賴 Rubber Band安裝包內(nèi)置設(shè)置面板安裝與第一次運(yùn)行三種系統(tǒng)一條流程先給結(jié)論能下官方安裝包就別自己裝環(huán)境。Windows 的UVR_v5.6.0_setup.exe和 macOS 的 DMG 包都內(nèi)置了 Python、PyTorch、FFmpeg雙擊安裝即用只有 Linux 或想二次修改時(shí)才需要手動(dòng)裝依賴。Windows下載安裝包裝到 C 盤官方建議裝到其他盤可能不穩(wěn)定。AMD 顯卡或 Intel Arc 顯卡用戶請(qǐng)選 OpenCL 版本。想手動(dòng)裝的話git clone https://gitcode.com/GitHub_Trending/ul/ultimatevocalremovergui cd ultimatevocalremovergui pip install -r requirements.txt python UVR.pymacOSM1/M2 芯片選 arm64 版Intel 芯片選 x86_64 版打開 DMG 拖進(jìn)應(yīng)用程序。首次啟動(dòng)可能要等 5~10 分鐘。如果系統(tǒng)提示無法打開在終端執(zhí)行一條命令放行用完后建議恢復(fù)sudo spctl --master-disableLinuxDebian/Ubuntu 系sudo apt install ffmpeg python3-pip python3-tk pip3 install -r requirements.txt python3 UVR.py裝好之后第一次分離按這個(gè)順序操作點(diǎn)Select Input選歌文件也可以直接拖進(jìn)輸入框按住 Ctrl 可多選做批量處理點(diǎn)Select Output指定輸出目錄輸出格式選WAV無損后續(xù)加工不二次壓縮Process Method 保持默認(rèn)的MDX-Net模型選默認(rèn)的MDX23C-InstVoc HQ點(diǎn)Start Processing等進(jìn)度條走完去輸出目錄聽結(jié)果參數(shù)調(diào)優(yōu)與避坑GPU 開關(guān)、Segment 和 Overlap 各管什么GPU Conversion 勾選框在方法選擇下方。有 NVIDIA 顯卡最低 RTX 1060 6GB8GB 顯存更穩(wěn)就勾上處理速度能提升幾倍AMD/Intel 顯卡請(qǐng)改用 OpenCL 安裝包Mac M 系列會(huì)自動(dòng)調(diào)用 GPU。這是整篇唯一需要為快做的事其余參數(shù)默認(rèn)即可。剩下兩個(gè)旋鈕控制的是切塊長(zhǎng)音頻會(huì)被切成一段段處理再拼回去。Segment Size切片長(zhǎng)度默認(rèn) 256編曲簡(jiǎn)單用 256~512復(fù)雜編曲降到 128~256極復(fù)雜的降到 64~128。它同時(shí)也是內(nèi)存占用上限遇到內(nèi)存分配報(bào)錯(cuò)第一反應(yīng)就是把它調(diào)小。Overlap相鄰切片的重疊倍數(shù)默認(rèn) 8管接縫質(zhì)量。對(duì)拼接處的噪音不滿意就提到 12~16嫌慢就降到 4~6。兩個(gè)習(xí)慣能省不少時(shí)間先勾 Sample Mode (30s)只跑 30 秒試聽確認(rèn)模型選對(duì)了再跑整曲參數(shù)調(diào)好之后存一組 Saved Settings下次直接調(diào)用UVR 也會(huì)自動(dòng)記住上次的設(shè)置 實(shí)戰(zhàn)路線卡拉OK、人聲采樣、播客各怎么走做卡拉OK伴奏Process Method 選 MDX-Net模型用 MDX23C-InstVoc HQ 或名稱帶 Karaoke 的 MDX 模型勾選 Instrumental Only只導(dǎo)出伴奏。跑完直接就是無原唱版本不需要手動(dòng)補(bǔ)什么。提取干凈人聲勾選 Vocals Only。如果目標(biāo)是做采樣、想拿到純凈的 lead vocal可以再疊加一個(gè)人聲拆分模型把主唱和和聲再拆開——界面上的人聲拆分選項(xiàng)會(huì)多導(dǎo)出_(lead_only)和_(backing_only)文件。播客去背景音樂方向反過來用 Vocals Only 拿說話聲、Instrumental Only 拿 BGM。兩條軌分開之后你才能在 DAW 里單獨(dú)壓 BGM 的音量而不是整段墊著背景樂。遇到問題時(shí)報(bào)錯(cuò)和殘留噪音去哪里找答案按出現(xiàn)頻率排四個(gè)高頻問題的處理路徑結(jié)果有噪音或人聲殘留先換模型這是最有效的一步再調(diào)小 Segment Size、調(diào)大 Overlap。還不行就打開Ensemble 模式把兩三個(gè)模型的輸出加權(quán)合并對(duì)壓低殘留非常明顯。處理 MP3/FLAC 時(shí)報(bào) FFmpeg 錯(cuò)誤說明 FFmpeg 沒就位。官方安裝包已內(nèi)置手動(dòng)安裝的用戶需要把 ffmpeg 可執(zhí)行文件放進(jìn) UVR 根目錄。內(nèi)存不足、程序崩潰調(diào)小 Segment Size或 VR 方法下的 Window Size8GB 內(nèi)存的機(jī)器別用 512 以上的切片。想看完整日志Start Processing 左側(cè)的扳手圖標(biāo)是 Settings 按鈕點(diǎn)開后選 Error Log可以把詳細(xì)報(bào)錯(cuò)信息貼到項(xiàng)目的 issue 里求助。進(jìn)階定位代碼的位置各模型的推理參數(shù)配置lib_v5/vr_network/modelparams/報(bào)錯(cuò)分類與提示邏輯gui_data/error_handling.py項(xiàng)目完整說明與已知問題README.md【免費(fèi)下載鏈接】ultimatevocalremoverguiGUI for a Vocal Remover that uses Deep Neural Networks.項(xiàng)目地址: https://gitcode.com/GitHub_Trending/ul/ultimatevocalremovergui創(chuàng)作聲明:本文部分內(nèi)容由AI輔助生成(AIGC),僅供參考