分离音质差 | UVR5 中文站
分离音质差的表现多样:人声发闷像隔了层布、伴奏被撕裂成碎片、出现金属感(ringing)、夹带电流声或嗡嗡底噪。这些大多不是软件坏了,而是源文件质量、模型匹配或参数设置没对齐,需要分层判断再逐项修复。
UVR5 三大引擎各有擅长:MDX-Net(onnx)最均衡常用,VR Architecture(pth)轻量可做去混响去噪,Demucs(波形域)多轨分离干净。选错引擎会加重某种瑕疵。
判断一:是源文件问题还是分离问题
- 先听原始音频:如果原文件本身就有底噪、录音闷、压缩损伤,分离再好也救不回来。
- 用一段清晰录音测试,若清晰源分离后依然差,才是参数或模型问题。
- 劣质的 MP3、电话录音、现场嘈杂录音本就难分离,需降低预期。
判断二:按瑕疵类型对症修
- 发闷:多半是选了过度降噪或去混响模型(如 UVR-DeEcho-DeReverb)或 VR 的 Aggression 过高,换均衡的 MDX-Net Main,降低 Aggression。
- 撕裂或金属声:Overlap 太小(如 0.25 以下)易在边界产生 artifact,把 Overlap 提到 0.5 左右缓解;也可换 Demucs 的 htdemucs_ft 这类更平滑的模型。
- 电流声或底噪:用 VR 的 UVR-DeNoise 降噪模型单独处理一遍,或在来源端换干净录音。
判断三:模型与集成模式
- 人声伴奏分离优先 MDX-Net 的 UVR-MDX-NET Main 或 Inst Main;要更干净多轨用 Demucs。
- 启用集成模式(Ensemble Mode)可叠加多个模型,算法选 Max Spec、Average、Min Spec,能抵消单一模型的缺陷,但更慢。
- 对同一文件试两个不同引擎,选听感更好的那个固定下来。
兜底方案
若单模型始终有某种瑕疵,用集成模式叠加两个互补模型(如一个主分离加一个去噪),通常能明显改善。硬件不足时降低输出规格换取稳定。
下一步建议
用 A/B 对比锁定问题模型
- 同一首歌分别用 MDX-Net Main 和 Demucs htdemucs_ft 各跑一次,盲听对比哪种瑕疵更轻。
- 如果两种模型都发闷,问题大概率在源文件,而不是参数,换 cleaner 的录音再试。
- 如果一种金属声重、一种撕裂重,用集成模式叠加二者,往往能互相抵消。
调音质不要一次改一堆参数,否则不知道哪项起作用。建议固定模型后,只动 Overlap(0.25 到 0.75 之间试)和是否开集成模式,逐步找到听感最好的组合。质量与速度天然有 trade-off,追求极致干净通常要接受更慢。先把源文件质量这块排除掉,再纠结参数,能少走很多弯路。
降噪与去混响的副作用
UVR-DeNoise、UVR-DeEcho-DeReverb 这类模型能压底噪和混响,但用过头会让人声发闷、丢失高频细节。除非源文件确实嘈杂或带房间回声,否则日常分离不必默认挂这些模型。把它们当作"补救手段"而非"标配",音质通常更自然。若已经发闷,先撤掉降噪去混响模型,换回均衡的 MDX-Net Main 再听一次。
先换清晰源测试,再按"发闷、撕裂、电流"对症调模型与 Overlap。修完音质若发现伴奏还有人声,看「伴奏人声残留」;若处理太慢,看「处理速度太慢」。