Featured image of post Wispr获2.8亿美元B轮融资:从AI听写走向会议与新交互

Wispr获2.8亿美元B轮融资:从AI听写走向会议与新交互

新融资将支持Wispr扩张会议工具与语音模型。

融资背后:AI听写公司估值升至20亿美元

融资背后:AI听写公司估值升至20亿美元

AI听写工具公司Wispr宣布完成2.8亿美元B轮融资,公司估值达到20亿美元,本轮由Menlo Ventures领投。Wispr表示,新资金将用于扩大市场覆盖,并推动公司进入听写之外的场景,其中最直接的方向是会议记录工具。

这轮融资距离Wispr上一轮融资不到10个月。完成本轮后,公司累计融资额达到3.61亿美元。对于一家以语音输入为核心产品的初创公司而言,这一融资规模反映出投资人仍看好“语音作为人机交互入口”的长期价值,也说明听写工具正在从单点效率产品,转向更广泛的工作流入口。

本轮融资中,Notable Capital、NEA、Neo Ventures、8VC、MVP Ventures等老股东继续加码;Acrew、Forerunner、Goodwater、Peak XV、Together Fund和PLUS Capital等新投资方加入。老股东续投与新机构进入并存,意味着资本市场不仅关注Wispr现有听写产品的增长,也在押注其向会议、硬件和新交互形态延伸的可能性。

从听写到会议:产品边界正在外扩

Wispr最初被用户认识,主要来自其AI听写应用。所谓AI听写,是指系统将用户语音实时或近实时转换为文字,并利用语音识别和语言模型修正表达、标点或格式,从而减少键盘输入成本。对普通技术用户来说,它的价值在于把“说话”变成可编辑文本,尤其适合移动办公、写作草稿、消息回复和长文本输入。

但听写市场正在变得拥挤。报道提到,Willow、Monologue、Aqua、Superwhisper等应用都在这一领域竞争,此外还有不少开发者推出面向专业消费者的免费或低价工具。价格下探和功能同质化会压缩单一听写产品的差异化空间,迫使领先公司寻找更高频、更深层的使用场景。

会议正是Wispr选择的新方向。公司新推出的会议记录工具可以展示会议摘要和行动项。会议记录产品通常承担三类任务:记录对话、提炼重点、跟进待办。相比单纯听写,会议场景更靠近团队协作与企业工作流,也更容易与日历、文档、邮件、项目管理等工具产生连接。报道也指出,Wispr的会议记录工具仍有进一步整合其他工具的空间,例如更新信息、创建文档或起草邮件。

在这一领域,Wispr将面对Granola、Fireflies、Read AI等竞争者。与个人听写相比,会议工具不仅考验语音识别准确率,还涉及摘要质量、多人对话理解、行动项提取以及与现有办公系统的适配能力。对企业用户而言,工具能否自然嵌入工作流程,往往比单次转写效果更重要。

Canto模型发布:回应质量波动与准确率压力

Canto模型发布:回应质量波动与准确率压力

与融资消息同时公布的,还有Wispr的新语音理解模型Canto。过去数周,一些用户抱怨Wispr Flow的听写输出质量下降。公司称,Canto将把错误率从30%降至低于10%。

关键数据包括:

  • B轮融资金额:2.8亿美元;
  • 最新估值:20亿美元;
  • 累计融资:3.61亿美元;
  • 新模型目标:错误率由30%降至低于10%;
  • 上一轮融资至今:不到10个月。

对听写产品而言,错误率不是一个抽象指标。用户口述内容后,如果需要花大量时间改错,语音输入节省的时间就会被抵消。因此,模型质量直接决定留存与付费意愿。尤其在竞争者提供低价甚至免费工具时,Wispr必须用更稳定的识别效果、跨场景体验或深度工作流能力来维持溢价。

过去一段时间,Wispr也在扩大市场和设备覆盖。自去年11月以来,公司已在Android上发布听写应用,并在印度、英国等地区扩充市场团队。移动端与国际市场扩张,有助于触达更多非桌面办公场景,而这些场景往往更依赖语音输入。

硬件合作与新界面实验

除软件扩张外,Wispr也在与硬件厂商合作,例如Oasis ring,让用户可以在设备上进行低声量听写。这一方向的意义在于,语音输入的最大阻碍之一并非技术,而是使用环境:用户未必愿意在办公室、通勤或公共场所大声对设备讲话。如果硬件能降低说话音量要求,语音交互可能更容易进入日常场景。

上个月,Wispr还宣布成立Wispr Interface Labs,由曾参与亚马逊Alexa早期工作的Ariya Rastrow负责。该实验室将探索新型人机交互界面。人机交互界面,简单说就是人向计算设备发出指令、接收反馈的方式;键盘、鼠标、触屏和语音助手都属于不同界面形态。

从这一布局看,Wispr并不想只做一个听写应用,而是试图围绕语音输入构建更广的交互层:用户说出想法,系统理解意图,并进一步生成摘要、待办、文档或邮件草稿。报道没有说明这些能力何时完整落地,但公司当前的融资、会议工具、模型升级和实验室方向,已经勾勒出扩张路径。

行业走向:语音入口仍有机会,但必须嵌入工作流

Wispr的新融资说明,AI语音输入仍被视为重要入口。不过,行业竞争也在提醒市场:单纯“把话变成字”很难长期构成护城河。随着基础语音识别能力普及,用户会更关注稳定性、价格、隐私体验、跨设备可用性,以及工具能否自动进入后续工作流程。

未来一段时间,Wispr的关键挑战在于两点:一是用Canto等模型修复质量波动并保持低错误率;二是让会议记录、硬件合作和新界面实验真正形成可持续使用场景。如果它能把听写从输入工具升级为工作流入口,20亿美元估值才有更清晰的支撑;如果不能,低价竞争者和会议AI玩家将持续挤压其增长空间。