XMOS 发布了新一代语音处理器 VocalFusion XVF3620,它将 AI 降噪技术与完整的片上语音处理流程相结合,即使在嘈杂、混响和动态环境中也能提供可靠的语音采集。该平台融合了 AI 降噪功能、全双工声学回声消除(带残余滤波)、双麦克风波束成形和自动增益控制。这款解决方案专为消费电子产品以及任何需要强大、真实场景语音性能的应用而设计。

作为音频、语音和物理 AI SoC领域的专家,XMOS 深知制造商对在日益增长的产品类别中提供可靠且先进的语音接口的需求不断增长。AI 音频处理带来的激动人心的可能性,提升了产品经理们对全新解决方案的期望。全新VocalFusion XVF3620处理器专为解决真实环境下的精准语音采集和自然通信问题而开发。
该器件融合了人工智能降噪、快速自适应声学回声消除(AEC)、双麦克风波束成形和自动增益控制(AGC)等技术,可在广泛的消费和工业应用中实现高质量的语音交互。在开发阶段,XMOS针对各种真实噪声环境(包括交通、雨天、雷暴、空调环境和繁忙的酒店环境)对这款全新解决方案进行了测试,结果表明,在所有测试噪声水平下,该方案均能保持始终如一的高语音质量、出色的感知性能和显著提升的信号清晰度。 XMOS
利用其XCORE 平台,打造出一款在实时并行处理方面表现卓越的处理器,足以应对语音产品面临的最大挑战。XCORE 提供了一种确定性的并行架构,能够同时执行多个任务而不会相互干扰,并在所有部署场景下可靠、可预测地完成这些任务。

XVF3620 专为智能家居设备、服务机器人、工业助手和户外应用而设计,可在抑制背景噪音的同时保持语音清晰度。其基于 AI 的降噪技术可根据特定应用需求和语音识别引擎进行调整,从而优化人机交互和语音 AI 界面的性能。该模型能够将语音与背景噪音分离,并经过多种噪音类型的训练,同时还能去除混响,从而确保语音质量。其低延迟特性使其适用于对讲和控制应用。
该处理器集成了全双工声学回声消除和先进的残余回声滤波功能,即使在音频播放过程中也能实现可靠的插话性能。为了简化产品开发,XVF3620 还将完整的数字语音处理链集成在单个器件上,包括 PDM 到 PCM 转换、波束成形、AI 降噪、多频段压缩、均衡和自动增益控制 (AGC)。这降低了系统复杂性,减少了成本,并加快了语音产品制造商的产品上市速度。
“语音正逐渐成为人与技术之间的主要交互方式,但嘈杂混乱的现实世界环境仍然对传统语音系统构成重大挑战。XVF3620 将尖端的 AI 音频处理技术与我们成熟的 XMOS 语音技术相结合,无论产品部署在何处,都能提供自然可靠的语音采集,”XMOS 产品营销总监 Tim Robjohns 表示。
VocalFusion XVF3620 处理器提供 USB 或 I²S(主控或从控)音频接口选项,以及 I²C、UART 或 USB HID 控制接口。它支持多种麦克风配置,可用于全指向拾音或增强嘈杂环境下的空间声场,并支持 PDM 麦克风与 XCORE 的直接连接。此外,它还集成了一个远端 DSP,用于均衡、限幅和多频段动态处理,从而充分发挥任何扬声器的性能。
XK Voice L71 双麦克风语音开发套件可用于评估 XVF3620 并制作语音产品的原型。它支持 USB 插件配件(通过 USB 控制接口)和内置语音功能(通过 I2C 控制接口)。
本文来自作者投稿,版权归原作者所有。如需转载,请注明出处:https://www.nxrte.com/zixun/70269.html