noise 使用指南
RNNoise 与 GTCRN:应该选择哪个降噪引擎?
没有适合所有情况的赢家。效果取决于噪声、人声和原始录音质量。
RNNoise 和 GTCRN 是什么
两个引擎都针对语音中的噪声。RNNoise 是基于循环神经网络的噪声抑制库。GTCRN 是为低计算需求设计的语音增强模型。项目描述本身并不能证明哪个在 noise 中效果更好。
扩展将它们作为两个处理选项。效果取决于背景、人声、源音质和强度。仅凭模型名称不能可靠判断哪一个更适合某段讲座或访谈。
用自己的视频对比引擎
- 找到包含正常语音、轻声词尾和停顿的一小段。
- 在 noise 中开启净化,选择 RNNoise,设置适中的降噪强度。
- 对比时保持人声音量均衡为零,关闭嗡声滤波,保持均衡器为中性设置。
- 听完后切换到 GTCRN,以相同音量和强度重播同一段。
- 对每个引擎分别对比原始音频和处理后音频,再单独调整您更喜欢的引擎的强度。
应该听什么
- 可懂度:轻声音节和词尾是否保留?
- 自然音色:人声是否变得带金属感、水声感或断续?
- 背景:语音和停顿时是否都更少干扰?
- 舒适度:能否舒适地连续收听几分钟?
相同百分比不代表相同效果
相同滑块位置是有用的起点,但不保证两个模型的净化效果相同。选择引擎后应再次调整强度。更强的背景去除不值得以丢失语音细节为代价。
哪个引擎更快?
没有针对您的设备和当前扩展版本的测量,就不能给出通用的速度或资源使用赢家。处理时音频断续,请在同一视频尝试另一引擎,并减少浏览器中其他高负载任务。
音乐和重叠人声
语音降噪可能改变音乐和其他有用声音,它不能从多位说话者中选出一位。此时尝试较低强度或原始音频。持续嗡声使用专用滤波器,音量变化使用人声音量均衡。