UVR5 人声分离完整教程:从导入到导出干声
这是使用 UVR5 的第一课:把一首歌里的人声干净地分离出来。整个流程大约五分钟设置、几分钟到十几分钟处理,跟着下面的步骤做即可。
第一步:导入音频文件
启动 UVR5,在界面左上方的 Select Input 区域,点击旁边的空白框或文件夹图标,选择你要处理的音频文件。支持 mp3、wav、flac、m4a 等常见格式。选好后点击 Verify Inputs,软件会校验文件完整性,列表中显示绿色对勾即为就绪。输入音质直接决定分离上限:能找到无损音源(wav、flac)就不要用高压缩的 mp3。
第二步:选择输出目录与格式
在 Select Output 区域设置分离结果的保存文件夹,然后在下方的输出格式里选择导出格式。日常听感用 wav 即可;如果后续要进剪辑软件或 RVC 训练,建议保留 flac 无损输出。
第三步:选择处理引擎与模型
在中间的处理方式区域,把引擎切换为 MDX-Net,然后在选择模型下拉框中挑选模型。新手直接选 UVR-MDX-NET Main,它是人声分离场景下最均衡的默认选择。第一次使用某个模型时,软件会提示模型尚未下载,点击下载更多模型,在 MDX-Net 分类里找到它并下载,或参考模型大全栏目了解每个模型的差异。
第四步:设置输出项与加速选项
在输出设置里勾选 Vocal Only(只导出人声)或 Instrumental Only(只导出伴奏),默认两项都输出,文件名会自动加上 vocals 或 instrumental 后缀。有 NVIDIA 显卡的用户记得勾选 GPU Conversion,处理速度会有数倍提升。参数区保持默认(segment size 256、overlap 0.25)即可满足大多数需求,更细的调优见参数详解教程。
第五步:开始处理与结果检查
点击 Start Processing,进度条走完后到输出目录试听结果。重点听三处:副歌高潮部分人声是否完整、伴奏轨道里是否还有明显的人声残留、人声轨道里是否有乐器串音。如果效果不满意,按下面的思路排查。
效果不满意的排查思路
- 人声里有明显混响:换用带去噪的 MDX 变体,或对结果再跑一次 UVR-DeEcho-DeReverb,方法见去回声与去混响指南。
- 伴奏里有人声残留:尝试 UVR-MDX-NET Inst 系列模型,或用集成模式让多模型投票。
- 整体发闷或撕裂:检查输入文件是否为高压缩转码,更换无损音源后重试。
- 处理速度过慢:确认已开启 GPU 转换;CPU 用户可适当调大 segment size 换取速度。
下一步
跑通人声分离后,建议继续学习伴奏提取教程,了解如何得到更适合 K 歌的伴奏;需要整批处理大量歌曲时,直接看批量处理教程。