LALAL.AI推出Lynx:用于语音去噪的神经网络

LALAL.AI 是一个由 AI 驱动的音频处理平台,被全球数百万音频工程师、视频制作人、记者、播客制作人和本地化团队使用。该平台宣布推出 Lynx,这是其首个专为语音降噪而设计的神经网络。

LALAL.AI推出Lynx:用于语音去噪的神经网络

Lynx 经过专门训练,能够将人声从背景音乐、人群噪音、机械干扰、环境音以及在非受控录音棚环境下制作的内容中存在的各种声学杂音中分离出来。最终生成一条干净的人声轨道,可直接用于后续后期制作,无需手动清理,从而节省了批量制作的时间。

LALAL.AI 产品负责人兼联合创始人 Nik Pogorsky 表示:“在语音降噪中,你并非要分离那些刻意录制在一起的声音,而是要从一个原本并非录音棚的环境中恢复人声。我们花了一年时间构建了一个模型,将这种情况视为真正的问题,而不是其他问题的次要情况。”

该模型比 LALAL.AI 的旗舰级云端词干分离模型 Andromeda 小六倍,在不影响输出质量的前提下降低了计算负载。该模型基于人工精心整理的数据集进行训练。由于目前尚无可靠的自动化流程能够从各种噪声源中清除真实世界语音的完整动态范围,团队花费数月时间手工挑选、过滤、修剪和准备音频轨道,涵盖从安静的访谈到嘈杂的现场录音等各种场景。

Lynx现已可通过LALAL.AI的语音净化器和语音降噪音轨使用,支持浏览器、移动应用、云端桌面应用以及LALAL.AI API。LALAL.AI自身的使用数据也反映了市场对专用语音净化功能的需求:由Lynx驱动的语音降噪音轨已成为该平台使用量第二大的分离音轨,预计2025年将处理超过1150万个音频分割。

Lynx 架构的计划改进包括增强合唱和群体人声的分离度,以及提高从远离麦克风录制的语音的隔离度。

本文来自作者投稿,版权归原作者所有。如需转载,请注明出处:https://www.nxrte.com/zixun/70374.html

(0)

相关推荐