Deepgram 为骁龙处理器提供边缘实时语音 AI 解决方案

Deepgram宣布了一项计划,旨在将企业级语音识别直接引入搭载骁龙® 处理器的PC。通过在骁龙X系列平台的Qualcomm® Hexagon™ NPU上优化Deepgram的Nova-3语音转文本模型,Deepgram助力开发者和设备制造商提供速度更快、更安全、更可靠的实时语音体验,而无需依赖云连接。此举将为语音技术进一步集成到新一代智能应用中铺平道路,这些应用涵盖汽车、移动设备、AI PC、XR、工业边缘计算、物联网和可穿戴设备等领域。

许多语音AI解决方案历来依赖于云端架构。每次交互都需要音频离开设备,传输到云端进行处理,然后再返回。这种方式有时会带来延迟和隐私问题,限制了语音AI的实际部署范围。Deepgram从根本上改变了这种模式,使语音识别能够直接在设备端进行。由此,无论是在车载系统、AI PC、XR头显,还是在网络连接不稳定的网络边缘,都能带来如同自然对话般的全新应用和用户体验。

“我们认识到语音AI技术满足不同的需求。正因如此,我们非常重视与Deepgram的合作,因为对于构建汽车系统、医疗保健应用、工业解决方案和其他关键任务体验的开发者而言,准确性、延迟、可靠性和可扩展性至关重要,”高通技术公司产品管理副总裁Upendra Kulkarni表示。“骁龙处理器的设备端AI功能与Deepgram的企业级语音AI相结合,以一种独特的方式将这些需求完美融合,为整个设备生态系统中的实时语音体验开辟了新的可能性。”

“语音优先交互的未来在于无论用户身处何地(车内、工厂车间、XR头显)都能与他们互动,同时确保准确性和响应速度,”Deepgram业务发展与合作副总裁Abe Pursell表示。“要实现这一点,我们需要企业级语音识别技术,并且能够在设备的限制范围内提供卓越的性能。我们将Deepgram Nova-3直接引入搭载骁龙处理器的PC生态系统,为将语音功能集成到各种产品中奠定基础,使用户无论身处何地、无论网络状况如何,都能使用语音交互。”

Nova-3 进一步提升了 Deepgram 业界领先的准确率,将其功能扩展到更广泛的实际企业应用场景和更具挑战性的音频环境。它是首个提供实时多语言转录的语音 AI 模型。Deepgram 也是首个为用户提供高效且高度精准的自助式定制功能的产品,无需重新训练模型即可实现即时词汇调整。卓越的准确率:Nova-3 在实际音频制作中以 6.89% 的词错误率遥遥领先,比排名第二的竞争对手低 24.7%。

本文来自作者投稿,版权归原作者所有。如需转载,请注明出处:https://www.nxrte.com/zixun/70310.html

(0)

相关推荐