十年匠心定制 · 商业建站与技术教学双线并行 咨询热线:400-886-1026 service@lmnt.cn
ARTICLE DETAIL

资讯详情

深耕网站建设与运营推广的一线实战洞察。

人声分离5分钟跑通:UVR Ultimate Vocal Remover 新手完整教程

人声分离5分钟跑通:UVR Ultimate Vocal Remover 新手完整教程 人声分离5分钟跑通UVR Ultimate Vocal Remover 新手完整教程【免费下载链接】ultimatevocalremoverguiGUI for a Vocal Remover that uses Deep Neural Networks.项目地址: https://gitcode.com/GitHub_Trending/ul/ultimatevocalremoverguiUltimate Vocal RemoverUVR是一款免费的开源人声分离工具它把 MDX-Net、VR 和 Demucs 三类深度学习模型装进一个图形界面把一首歌拆成人声、伴奏、鼓、贝斯等独立音轨全程本地运行文件不上传。适合翻唱练习、混音采样和音频修复的场景也适合不想碰代码的新手。第一次使用三条最短路径三种系统都能跑差异只在第一步。选对路径后剩下的操作是一样的选输入文件 → 选模型 → 点 Start Processing。平台最短路径关键差异Windows 10/11 64位下载官方安装包UVR_v5.6.0_setup.exe必须装到C 盘根目录装到其他盘会不稳定AMD Radeon / Intel Arc 显卡改下 OpenCL 版安装包macOS 11 (Big Sur) 及以上下载 DMG 拖入 ApplicationsM1/M2 选 arm64 包Intel 选 x86_64 包首次启动初始化约 5–10 分钟LinuxDebian/Ubuntu/Arch装好系统依赖后运行python3 UVR.py需要ffmpeg和python3-tk两个系统包 想走源码路线需要改参数、换模型文件时更灵活四个命令即可git clone https://gitcode.com/GitHub_Trending/ul/ultimatevocalremovergui cd ultimatevocalremovergui pip install -r requirements.txt python UVR.py三个平台的两个注意点Python 版本源码方式建议 Windows 用 3.9.8、macOS 用 3.10安装时勾选 “Add python.exe to PATH”。NVIDIA 显卡默认的 PyTorch 不带 CUDA 内核需单独升级到 cu117 轮子版没有 NVIDIA 卡的机器跳过这一步纯 CPU 也能跑只是慢。场景一只要人声或只要伴奏这是 90% 的用例。主界面里 “Choose Process Method” 下拉选MDX-Net质量上限高或VR速度快、占资源少模型选带 “VocHQ / InstVoc” 字样的即可如 MDX23C-InstVoc HQ。界面上有三个复选框直接控制产出Vocals Only只输出人声轨省一半时间Instrumental Only只输出伴奏轨GPU Conversion有独立显卡就勾上NVIDIA 卡生效AMD/Intel 卡靠 OpenCL 版安装包。输出格式在 WAV / FLAC / MP3 里三选一WAV 无损但大MP3 方便分享。处理前先勾Sample Mode (30s)试跑 30 秒确认效果再放开整曲这是避免白等半小时的最便宜保险。场景二要鼓点、贝斯等多轨分离Demucs 系列是 UVR 内置的多轨引擎一次出 4 轨人声/鼓/贝斯/其他v4 版本另有 6 轨配置。流程与 MDX-Net 相同只是 “Choose Process Method” 改选Demucs然后勾选需要的 stems。它的特点速度比 MDX-Net 慢但鼓和贝斯的定位更干净做 remix 首选可以叠加一个“二次模型”对某个轨再精修一次默认参数voc/inst 比例 0.9先不动听出偏差再调M1/M2 的 Mac 上 Demucs v4 和全部 MDX-Net 模型都支持 MPS 加速不用降级到 CPU。处理非 WAV 文件MP3、FLAC 等依赖 FFmpeg用Time Stretch / Change Pitch功能则还需要 Rubber Band 可执行文件放进程序目录。两者都是系统级小工具缺哪个哪个功能就报红。避坑指南现象 → 原因 → 解法现象原因解法Windows 版打不开或运行中闪退装在了非 C 盘重装到 C:\ 根目录拖入 MP3/FLAC 报错没装 FFmpegsudo apt install ffmpegWindows 下载预编译版把ffmpeg.exe放进程序目录勾了 GPU 仍走 CPUPyTorch 是纯 CPU 版或显卡不支持先跑一条命令验证python -c import torch; print(torch.cuda.is_available())False 就重装 cu117 轮子AMD/Intel 卡换 OpenCL 版macOS 提示“已损坏/无法打开”Gatekeeper 隔离属性终端执行sudo spctl --master-disable再sudo xattr -rd com.apple.quarantine /Applications/Ultimate\ Vocal\ Remover.app开完记得spctl --master-enable恢复首次启动卡住很久自动下载模型 初始化Mac 上 5–10 分钟属正常模型下载慢时可按 gui_data/model_manual_download.json 列的地址手动下载后放进models/对应子目录Time Stretch 功能灰掉没装 Rubber Band下载对应系统可执行文件放入程序目录Linux 下install_packages.sh只装 pip 依赖不含它⚠️ 排查顺序建议先看应用内置的错误日志面板再看上表大多数“应用无法启动”最终都是缺依赖重跑一遍pip install -r requirements.txt即可。进阶调优真正影响体验的 3 条Segment Size 与 Overlap默认分段 256ms、overlap 8。长音频吃显存时把分段调小如 128重叠率保持在 8–12 之间分段边界处的爆音会消失。显存碎片大文件报 OOM 时设置环境变量PYTORCH_CUDA_ALLOC_CONFmax_split_size_mb:512多数情况能直接解决。模型目录三类模型分别放在models/MDX_Net_Models/、models/VR_Models/、models/Demucs_Models/。模型文件是主要体积来源整个包约 2GB想精简安装或批量换模型直接管理这三个目录即可models/MDX_Net_Models/model_data/ 下的 YAML 即各模型的结构配置。下一步装好后跑一首熟悉的歌做基准记下“人声 伴奏”的耗时和产物位置输出目录在 Select Output 里选。之后遇到报错先翻应用内日志再查 README.md 的 Troubleshooting 段落跟进 install_packages.sh 与 README 的版本更新说明5.6 系列的补丁安装包支持直接覆盖安装不用重新配环境。【免费下载链接】ultimatevocalremoverguiGUI for a Vocal Remover that uses Deep Neural Networks.项目地址: https://gitcode.com/GitHub_Trending/ul/ultimatevocalremovergui创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表