
UVR5 人声分离与伴奏提取快速上手免费 AI 分轨参数调校与排障指南【免费下载链接】ultimatevocalremoverguiGUI for a Vocal Remover that uses Deep Neural Networks.项目地址: https://gitcode.com/GitHub_Trending/ul/ultimatevocalremovergui剪视频想用一首流行歌当 BGM人声总在画面上方抢戏这个需求有个免费解法Ultimate Vocal RemoverUVR5是一款开源 AI 人声分离工具把音频一键拆成伴奏与干声图形界面操作不需要任何音频工程背景。十分钟装好拿到第一版伴奏界面长这样左侧放输入输出与格式中间是算法、模型和参数底部只有一个 Start Processing 按钮。从零到第一版伴奏做这几件事就行安装二选一。官方一体化安装包内置 Python、PyTorch、FFmpeg装完即用源码运行则克隆仓库装依赖git clone https://gitcode.com/GitHub_Trending/ul/ultimatevocalremovergui pip install -r requirements.txtNVIDIA 显卡用户补一步把 PyTorch 升到 CUDA 版推理速度通常提升数倍pip install torch torchvision torchaudio --index-url https://download.pytorch.org/whl/cu117首次运行会自动下载模型等它下完再操作。点 Select Input 选音频Select Output 指定保存目录输出格式选 WAV 或 FLAC。算法保持 MDX-Net一种两轨分离网络出活快模型选 MDX23C-InstVoc HQ标准的人声/伴奏双轨模型。参数不动用默认值SEGMENT SIZE 256、OVERLAP 8有显卡就勾 GPU Conversion然后 Start Processing。 想先验证效果勾上 Sample Mode (30s)程序只处理前 30 秒确认满意再跑全长。跑完后输出目录出现两个文件歌曲名_(Vocals).wav是干声歌曲名_(Instrumental).wav就是你要的伴奏。一分钟原理AI 按声源分离不按频率切传统软件消人声按钮出来的声音闷而空因为它用固定滤波器把 vocals 集中出现的频段直接挖掉可人声与吉他、键盘的泛音正叠在那个频段上挖频等于连乐器一起挖。AI 模型靠大量标注音频学会另一件事人声和各乐器在时间与频率上分别以什么形态出现。UVR5 的三个算法家族都是按声源拆混音先估计每个声源的贡献再各自成轨。所以伴奏不是被挖出来的而是被拆下来的空间感和细节都保得住。按素材类型挑算法与模型三种算法家族、三种拆法UVR5 把它们装进同一个窗口各带独立模型目录MDX-Net源码在 lib_v5/mdxnet.py推理快两轨人声/伴奏拆分稳定Demucs v3/v4源码在 demucs/支持人声/鼓/贝斯/其他四轨拆分VR 架构模型配置在lib_v5/vr_network/模型版本多专项去乐器、降噪都有。模型文件落在 models/ 下三个子目录models/MDX_Net_Models/各模型的 yaml 配置在mdx_c_configs子目录里、models/Demucs_Models/、models/VR_Models/自带UVR-DeNoise-Lite.pth可先做一遍降噪。首次运行自动下载网络不顺畅就手动把文件丢进对应目录。对号入座即可素材类型推荐算法/模型关键参数流行/摇滚日常要伴奏MDX-NetMDX23C-InstVoc HQSegment Size 256 / Overlap 8编曲复杂要鼓、贝斯分轨Demucs v4四轨拆分参数保持默认只想去掉特定乐器VR4band_44100 No Piano有接缝时把 overlap 调大素材本身底噪大先用 VR 的 UVR-DeNoise-Lite.pth 降噪再分离降噪后按原参数处理两个参数决定质量与速度的取舍Segment Size分段大小是 AI 每次推理的窗口长度选 128 省内存、适合老设备512 质量更好但吃显存Overlap重叠率控制相邻窗口的重叠程度太小会有接缝和咔哒声越大拼接越自然耗时也越长。⚡ 提速技巧与排障自查设备调度逻辑写在 separate.py自动检测 NVIDIA 的 CUDA 与 macOS 的 MPS可用就走 GPU。AI 推理是计算密集型任务有显卡时5 分钟音频能从十几分钟压到一两分钟。文件多的时候界面里可以直接排队批量处理也可以写个小脚本遍历目录、把文件逐个交给UVR.py省掉手动点选。常见症状对号入座症状一句话对策CUDA out of memory调小 Segment Size或取消 GPU Conversion输出有咔哒声、段落接缝Overlap 加到 16 或 24模型下载失败或极慢手动下载模型文件放进 models/ 对应子目录界面打不开补装 tkinter/ffmpeg 依赖或改用一体化安装包挑一首你最熟悉的歌用 UVR5 分出伴奏再跟着录一版自己的演唱。结果有接缝就把 Overlap 加到 16人声残留就换 Demucs v4 再跑一遍——两次小调整通常就能得到一版干净得像官方发行的伴奏。【免费下载链接】ultimatevocalremoverguiGUI for a Vocal Remover that uses Deep Neural Networks.项目地址: https://gitcode.com/GitHub_Trending/ul/ultimatevocalremovergui创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考