語音 AI 已成為人工智慧領域最熱門的產業之一,投資者投入數十億美元,應用範圍從自動化客戶支援和銷售電話,到建立會議記錄工具,以及開發以語音為主要互動介面的 AI 智慧眼鏡。同時,AI 實驗室正快速發布新模型,硬體製造商也努力為消費者創造最佳的裝置互動體驗。
所有這些新技術都需要測試和回饋機制來改進。冰島新創公司 Treble 正透過打造一個能滿足模型開發商、機器人公司和消費硬體製造商需求的模擬平台,將自己定位在語音 AI 產業的核心。
這家公司由聲學工程師 Finnur Pind 和 Jesper Pedersen 於 2020 年創立,近期在 Paladin Capital Group 領投的 A 輪擴展募資中,成功籌得 1800 萬美元。現有投資者 KOMPAS VC、Frumtak Ventures、EIC 和 Omega ehf 也參與了本輪投資。
加上 2024 年獲得的 1200 萬美元投資,該公司迄今累計募資總額已超過 4000 萬美元。Amazon 和 Logitech 都是這家新創的客戶。
Treble 在模擬和數據方面擁有多個垂直領域。對於語音 AI 公司,它提供一個合成數據生成平台,可用於語音增強、噪音抑制和模型訓練。該平台還能在不同條件下評估語音 AI 模型,為實驗室提供回饋。今年稍早,Treble 與 Hugging Face 合作,推出了一個用於評估語音辨識模型在各種真實條件下表現的基準測試。
Pind 向 TechCrunch 表示:「音訊 AI 確實是一項數據挑戰,這也是實現下一代模型和硬體的最大機會所在。迄今為止,幾乎所有與聲音相關的 AI 都是透過錄音和從網路抓取的數據來建立的。我們相信,精確的物理模擬可以成為一種創造聲音數據的替代方法。」
這家新創公司也從語音角度專注於硬體設計和測試。例如,它與耳機和揚聲器公司合作進行虛擬原型設計,幫助他們了解產品的音質表現。它還可以測試智慧音箱如何根據其擺放位置來理解指令。最近,Treble 已涉足為智慧眼鏡和 AI 裝置提供模擬測試服務。
Pind 表示,該公司很高興能開發可增強用戶聽力的穿戴式裝置。他說:「我對下一代耳機和智慧眼鏡等裝置感到非常興奮,它們可以實現『超人聽力』等功能。在具挑戰性的聲學環境中,這是一個能讓你聽得更清楚的領域。也許你在餐廳裡,只想聽到兩公尺範圍內的人說話,或者你在研討會上,想讓周圍的人靜音。」
Treble 旨在加強其在實體 AI 領域的關注,包括機器人、汽車和無人機公司,透過測試和模擬為它們實現基於聲音的功能。
Paladin Capital Group 副總裁 Francois Ruether 向 TechCrunch 表示,Treble 能夠模擬不同模型和裝置的平台非常突出;隨著其涉足更多領域,該平台的重要性將會增加。
Ruether 說:「我們的論點是,隨著越來越多的產品依賴於理解聲音,這種基礎設施在語音 AI、穿戴式裝置、機器人技術和實體 AI 領域將變得越來越有價值。客戶保留其模型、產品和開發工作流程的所有權,同時受益於模擬原生聲學基礎設施層的共享基礎。」
