Wispr Flow 融资 2.8 亿美元并推出语音 AI 模型

2026 年 8 月 17 日,开发跨平台 AI 语音识别平台的 Wispr AI Inc. 宣布,已完成 B 轮融资,筹集资金 2.8 亿美元,估值达 20 亿美元。

Wispr Flow 融资 2.8 亿美元并推出语音 AI 模型

Menlo Ventures领投了本轮融资,现有投资者Notable Capital、NEA、Neo Ventures、8VC和MVP Ventures也参与了投资。新投资者Acrew、Forerunner、Goodwater、Peak XV、Together Fund和PLUS Capital也加入了投资行列,使该公司融资总额达到3.61亿美元。

Wispr 的主要产品是 Flow,这是一款文本转语音工具,可集成到各种应用程序中,让用户能够对着任何文本框自然地说话。它能识别口语,修正语法错误、口误、语气词(例如“嗯”、“啊”)以及口吃等,并生成清晰易读的电子邮件、备忘录和文档。这使得该工具在移动设备、桌面电脑以及其他用户可能希望直接对着电脑说话而不是使用键盘的环境中都非常实用。

除了获得融资外,该公司还宣布推出其首个自主研发的人工智能模型 Canto 的预览版。

与大多数语音模型不同,Canto 经过训练,能够在各种语音变化、嘈杂环境(包括噪音、干扰、狗吠、其他人声、背景噪音以及日常生活的声音)中识别语音。该公司表示,大多数语音模型都使用极其纯净的语音素材进行训练,以提供纯净的人声。Canto 则使用了一些示例,使其能够快速地将人声从环境噪音中分离出来——这样,用户就可以在家中、车里、交通噪音环境中或办公室里使用他们的应用程序。

Wispr 表示,当 Canto 集成到该公司的语音识别工具 Flow 中时,嘈杂环境下的错误率从 30% 下降到接近 5% 至 10%。

在安静的房间里,大多数现代 AI 转录功能都能做到非常流畅,只会出现一些细微的错误。但在嘈杂的环境中,则可能造成灾难性的后果。过去十年间,大多数文本转语音应用程序都被用于移动办公等简单任务,例如查询天气、询问时间或进行简单的网络搜索,因为这些任务通常只涉及几个词,出错的几率很小。

借助 Canto 提供的系统,人们可以坐在车里,即使在嘈杂的环境中,也能畅所欲言地讨论想法,而该系统会将大部分文字记录到电子文档中。这在一年前是文本转语音模型难以实现的。

“我每天都用Flow,”三届NBA全明星球员多曼塔斯·萨博尼斯说。“我从小就交替使用英语、西班牙语和立陶宛语,无论我用哪种语言,它都能跟上我的节奏。”

随着技术的进步,受益于转录应用程序的不仅仅是NBA球员和商界人士。聋人和听力障碍人士也在移动设备上使用人工智能转录,多人对话和嘈杂的环境会导致转录文本出现一些有趣的错误;尽管许多人主要依赖设备端转录,但云模式的演进正在推动整个行业向前发展。

Wispr表示,用户在Flow上撰写的文字已超过600亿字。其产品也被几乎所有财富500强企业和超过1万家企业使用,证明了其跨行业的应用价值。

本文来自作者投稿,版权归原作者所有。如需转载,请注明出处:https://www.nxrte.com/zixun/71218.html

(0)

相关推荐