UVR5 MDX-Net 引擎模型详解与选择建议

MDX-Net 是 UVR5 中使用频率最高的引擎,基于频域Masking(掩蔽)思路的神经网络架构,模型文件为 onnx 格式,推理速度快、质量均衡,新手首选。

引擎特点

MDX-Net 系列对流行、摇滚等常见曲风的人声剥离表现稳定,社区围绕它发布了大量针对不同场景优化的变体。它同时提供人声向(提取干净人声)与伴奏向(抑制人声、保留完整伴奏)两类模型,配合 UVR5 的输出开关即可覆盖分离的核心需求。配合 segment size 与 overlap 参数调节,能在多数硬件上取得速度与质量的平衡。

常用模型清单

选择建议

按场景给结论:日常人声分离选 Main;做伴奏选 Inst Main,不满意再叠加 Inst 3 上集成模式;追求极限质量且音源无损,试 HQ 系列与 Kim 系列并 A/B 对比。模型之间没有绝对胜负,同一首歌不同模型的结果可能差异明显,试听永远是最终裁判。

为什么 MDX-Net 适合当第一颗模型

对比另外两个引擎,MDX-Net 的优势是均衡:VR 引擎速度快但单模型质量略逊,Demucs 音色自然但模型体积大、处理慢。MDX-Net 在速度、体积与质量之间取得了最好的平衡,而且社区围绕它的变体最多,遇到特殊音源时总有替代选择。对新手来说,先用它建立对分离效果的合理预期,再决定是否需要为特定场景引入其他引擎,是最平滑的学习路径。

下载与安装位置

在 UVR5 中点击选择模型旁的下载更多模型,切到 MDX-Net 分类即可在线下载。手动安装时,把 onnx 文件放进安装目录 models 文件夹下的 MDXNET 子目录,重启软件即可在下拉列表中看到。模型下载失败的备选方案见 FAQ。

与另外两个引擎的关系

需要轻量快速或专门的去混响处理时,看 VR Architecture 引擎详解;需要鼓、贝斯等乐器分轨时,看 Demucs 引擎详解。三大引擎可以在集成模式里跨引擎组合,取各家之长。