资讯详情

资讯详情

用 UVR 三步分离人声,导出干净伴奏

用 UVR 三步分离人声导出干净伴奏【免费下载链接】ultimatevocalremoverguiGUI for a Vocal Remover that uses Deep Neural Networks.项目地址: https://gitcode.com/GitHub_Trending/ul/ultimatevocalremovergui想把人声从伴奏里摘出来Ultimate Vocal Remover GUI简称 UVR当前 v5.6.0是个免费开源的人声分离工具。它用深度神经网络把一首歌拆成人声、伴奏运气好还能拆出鼓点、贝斯各一条独立音轨。下面按能不能装 → 怎么装 → 第一次跑的顺序说清楚。你的电脑跑不跑得动先对一下系统底线三选一都对得上就能开工Windows10 及以上 64 位Win11 更稳macOSBig Sur 11.0 以上Monterey 12.0 以上更好LinuxDebian/Arch 系Ubuntu 20.04 起步22.04 最佳硬件方面内存 8GB 起步比较从容。有 NVIDIA 显卡的话RTX 1060 6GB 是 GPU 加速的门槛8GB 显存体验最佳没有独显也能跑只是慢一些。Apple M1/M2 芯片已支持 MPS 加速Demucs v4 和全部 MDX-Net 模型。⚠️ 有一条老规矩Windows 版必须装在C 盘根目录。装到其他盘容易出各种不稳定别问为什么。三个系统怎么装下载物按系统对号入座。安装包里已打包 Python、PyTorch 和全部依赖不用提前准备环境系统下载文件大小备注WindowsUVR_v5.6.0_setup.exe以 release 页为准NVIDIA 显卡、64 位WindowsUVR_v5.6.0_setup_opencl.exe同上AMD / Intel 显卡用这个macOSUltimate_Vocal_Remover_v5_6_MacOS_arm64.dmg约 2.1 GBApple SiliconmacOSUltimate_Vocal_Remover_v5_6_MacOS_x86_64.dmg约 2.0 GBIntel 芯片Linux源码仓库 依赖几 MBDebian/Arch 系Windows双击 exe路径保持 C 盘根目录等 5-10 分钟。AMD 或 Intel 显卡的用户请改用 opencl 版。想手动装也行——用 Python 3.9.8 克隆仓库后执行python -m pip install -r requirements.txtNVIDIA 显卡可以再装一个 cu117 版本的 CUDA 版 torch打开加速。macOS双击 dmg把应用拖进应用程序。首次启动要初始化 5-10 分钟别急这是正常的。提示无法打开时终端里执行sudo spctl --master-disable sudo xattr -rd com.apple.quarantine /Applications/Ultimate\ Vocal\ Remover.app能打开之后建议再执行sudo spctl --master-enable把安全设置还原。LinuxDebian/Ubuntu 系先装系统级依赖再装 Python 包sudo apt install ffmpeg python3-pip python3-tk pip3 install -r requirements.txt python3 UVR.pyArch/Manjaro 换成sudo pacman -S python-pip tk ffmpeg然后跑项目自带的./install_packages.sh批量装 Python 包。第一次分离只要四步左侧 Choose Process Method 选 MDX-Net新手首选快。首次使用去下方 Download Center 把对应模型下下来只下一次。Select Input 选一首歌Select Output 指定输出目录右上角选导出格式。WAV 无损优先。有 NVIDIA 显卡就勾上 GPU Conversion。点 Start Processing等进度条走完。输出目录里会出现 Vocals 和 Instrumental 两个文件。人声干净、伴奏完整就说明环境全通了。模型怎么挑这一步决定效果先想清楚自己要什么只要人声 伴奏MDX-Net 或 VR Architecture速度快要鼓、贝斯独立音轨Demucs v4即 htdemucs 四轨想要六轨选 htdemucs_6s源文件底噪大先跑一遍 UVR-DeNoise-Lite 降噪再做正式分离结果更稳模型权重已内置在安装包里其中 Demucs v3/v4 四轨模型来自 Demucs 官方其余由 UVR 核心开发者训练。效果不满意调这三处内存吃紧或文件很大把 Segment Size 从 256 往下调比如 128Overlap 保持 8 左右就行导出格式MP3 方便分享交付成品选 WAV 或 FLAC同一首歌想换风格切到 Demucs 系列重新跑一次对比着听再定设置会在关闭窗口时自动保存不用手动导出。常见报错与处理现象处理非 WAV 文件加载报错装 FFmpegWindows 把 ffmpeg.exe 放进应用目录内存分配错误调小 Segment Size 和 WindowGPU 加速不生效重装 cu117 版 torch和 CUDA 对齐macOS 左键点不动升级到 v5.6 最新版Sonoma 已知问题已修启动即崩溃重跑pip install -r requirements.txt 细节报错可以点 Start Processing 左侧 Settings 里的 Error Log 查看定位快很多。想深入看看源码模型文件集中在models/下的 VR_Models、MDX_Net_Models、Demucs_Models 三个目录手动下载的模型放进对应位置即可离线使用完整清单见 gui_data/model_manual_download.json。分离逻辑的核心在 separate.py界面逻辑在 UVR.py网络参数在 lib_v5/vr_network/modelparams/。【免费下载链接】ultimatevocalremoverguiGUI for a Vocal Remover that uses Deep Neural Networks.项目地址: https://gitcode.com/GitHub_Trending/ul/ultimatevocalremovergui创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
觉得有用,分享给同行:

为您的企业打造数字门面

稳重轻奢商务风格,端正雅致视觉,长效耐看不易过时。

立即咨询 →