底噪与信噪比 | UVR5 中文站

底噪(Noise Floor)指设备或环境在录无声源时也存在的本底噪声,表现为持续的沙沙声或电流声。信噪比(Signal-to-Noise Ratio,简称 SNR)则是有效信号强度相对底噪的比值,数值越高越干净。在 UVR5 里,底噪会直接干扰模型判断,是分离质量常被忽视的杀手。

很多人分离后发现「人声里总有嘶嘶声」,其实那不是模型没拆干净,而是原始文件的底噪(Noise Floor)被一起保留了下来。下面讲清来源、影响与降噪边界。

底噪来自哪里

它对分离的干扰

底噪(Noise Floor)会拉低信噪比(SNR),带来两个麻烦:一是模型可能把稳定的噪声误判为某个声源的持续成分,导致伴奏或人声里残留嘶声;二是噪声会压低信号失真比这类质量指标的分数,让人误以为分离失败。信噪比越低,模型可利用的「干净特征」越少,结果越容易串音,这是底层限制而非模型不行。

降噪边界

UVR5 提供 VR 架构的 UVR-DeNoise 模型专门降噪。但降噪有边界:

情形建议
轻微底噪直接用 UVR-DeNoise,听感改善明显
强电流声先源头换线或重录,软件难彻底去除
噪声与歌声频段重叠过度降噪会伤人声齿音,需轻度多遍

降噪本质是取舍:去掉噪声的同时也会削掉一点有用信号。别指望把信噪比极差的素材救成录音棚品质,源头干净永远比后期补救重要。

如何在导入前预判底噪

导入 UVR5 前,可先在无音处放大波形看是否有持续起伏的噪声层:起伏均匀的多是设备底噪,带规律嗡嗡声的多是电源干扰。也可以在安静段落 solo 试听,能听到稳定嘶声就说明信噪比偏低。提前知道底噪类型,才能决定用 UVR-DeNoise 还是回去换线重录,避免白跑一遍分离。若底噪伴随明显交流声(五十赫兹或六十赫兹的嗡鸣),软件降噪很难根除,源头换电源或音频线才是正解,别把希望全压在后期,那样既费时又难彻底干净。

常见误解

底噪越低分离一定越好吗?

在合理范围内是的,但前提是源素材本身。若原文件信噪比本就高,再降噪只是徒增处理时间并可能损伤听感,并非越低越好,要结合原始质量决定。

下一步建议

若你的素材既有回响又有噪声,先读「混响与回声」分清二者再分别处理;想量化分离好坏,看「信号失真比是什么」。导出时选高位深也能从文件层面压低量化底噪,和降噪模型配合效果更好。