語音 AI 新創 Wispr 以 20 億美元估值募得 2.8 億美元,較先前估值成長近三倍,投資人押注語音將成為 AI 的主要介面。
語音 AI 新創 Wispr 以 20 億美元估值募得 2.8 億美元,較先前估值成長近三倍,投資人押注語音將成為 AI 的主要介面。

語音 AI 新創 Wispr 以 20 億美元估值募得 2.8 億美元,較先前估值成長近三倍,投資人押注語音將成為 AI 的主要介面。
Wispr 以 20 億美元估值募得 2.8 億美元,較先前估值成長近三倍,投資人押注語音將成為 AI 的主要介面。此輪 B 輪融資由 Menlo Ventures 領投,總募資金額累計達 3.61 億美元,距離超額認購的 A2 輪僅相隔六個月。
Menlo Ventures 合夥人 Matt Kraning 表示:「AI 的瓶頸已從模型轉移到人機介面,而 Wispr 正是那個介面。我們看到 Flow 在還沒有銷售團隊的情況下,便滲透到大部分財星 500 大企業,靠的是員工一座辦公桌接一座辦公桌地口耳相傳。」
Wispr 的旗艦聽寫產品 Flow 目前已在超過 12.5 萬家企業中擁有數百萬用戶,包括多數財星 500 大企業的員工。過去四季每季營收成長均超過 150%。伴隨這輪募資,Wispr 同時預覽了其首款自有的語音模型 Canto,該模型在嘈雜環境、強風及濃重口音下,可將字錯誤率從超過 30% 降至約 5% 至 10%。
募得資金將用於資助 Wispr Advanced Interfaces Lab,該實驗室由 Amazon Alexa 團隊創始成員、曾任 Meta 多模態基礎模型負責人的 Ariya Rastrow 領導。Wispr 計畫將語音應用從聽寫延伸至穿戴裝置及其他硬體,與會議記錄工具 Granola、Fireflies 和 Read AI 展開競爭。
傳統語音辨識系統以受控的基準音訊進行訓練,在人們實際聽寫的嘈雜環境中往往失效。Canto 則以真實世界的使用數據及來自 Flow 的情境訊號進行訓練,能應對背景噪音、強風與濃重口音。Wispr 表示,使用者因此可減少約 30% 至 35% 的聽寫後編輯需求。該公司未透露此比較的測試條件。
這款模型標誌著 Wispr 從應用層公司轉向自行建構底層 AI 技術。掌握語音模型使 Wispr 能針對 Flow 所產生的特定環境與互動模式進行優化,而非依賴第三方轉錄引擎。此次推出正值用戶連續數週抱怨 Flow 聽寫輸出品質下滑之際,公司將此歸因於向 Canto 的過渡。
Wispr 的核心理念是,AI 模型的智慧發展速度已超越人們與這些模型溝通的介面。儘管 AI 系統能理解複雜指令,但多數互動仍始於在文字方框中打字。Wispr 認為語音是縮短思考與表達之間摩擦的方式。
該公司研究實驗室正著手探索穿戴裝置——在這些裝置上,鍵盤與螢幕較不實用。Wispr 也與 Oasis 戒指等硬體製造商合作,讓客戶無需大聲說話即可聽寫,並推出了與 Granola、Fireflies 及 Read AI 競爭的會議記錄工具。
聽寫市場正日益擁擠。Willow、Monologue、Aqua 與 Superwhisper 等應用程式以較低價格鎖定專業消費者,而 Microsoft 旗下的 Nuance 主導醫療聽寫領域,Otter.ai 則在會議轉錄市場佔有一席之地。Deepgram 提供開發者友好的語音 API。Wispr 若要合理化其估值溢價,必須展現深刻的差異化優勢——無論是突破性的精確度,或是將語音從功能轉化為基礎設施的平台級布局。
Wispr 的 20 億美元估值使其在語音 AI 專業領域中躋身罕見行列,約為許多同階段企業級 SaaS 公司估值的兩倍。該公司的企業採用屬有機成長——由員工自發引入而非傳統自上而下的銷售團隊驅動——Menlo Ventures 將此視為產品市場契合度的佐證。此輪投資也吸引了包括 Livvy Dunne、Shaun White、Dak Prescott 和 Klay Thompson 在內的運動員及文化界人士,顯示 Wispr 正在建立的消費者號召力。Wispr 能否將聽寫動能轉化為更廣泛的語音驅動人機互動平台,將決定其估值能否持續。
本文僅供資訊參考,不構成投資建議。