DeepL 迅速收購 Mixhalo,將即時 AI 語音翻譯帶入體育場和現場活動

新聞摘要
德國人工智慧驅動的語言翻譯公司 DeepL 於 2026 年 6 月 17 日(美國東部時間)宣布,已收購專注於超低延遲即時音訊串流技術的舊金山新創公司 Mixhalo。此項交易標誌著 DeepL 的語音翻譯能力將擴展至體育場館、競技場館及大型現場活動的關鍵一步。
什麼是 Mixhalo?
Mixhalo 於 2016 年由音樂家 Mike Einziger(搖滾樂團 Incubus 的吉他手)、小提琴家 Ann Marie Simpson-Einziger 以及科技企業家兼執行長 Vik Singh 共同創立。Mixhalo 最初旨在提升演唱會聽眾的音訊品質,後來發展成為一個企業級的即時音訊平台,已在包括 Metallica 和 Sting 演唱會、美國職棒大聯盟比賽及 NASCAR 賽事等眾多知名活動中部署。Verizon 和 T-Mobile 等品牌也曾利用其技術為實體場館內的廣大觀眾提供同步的音訊體驗。
策略考量
此次收購為 DeepL 帶來了一個位於舊金山的工程團隊,約有二十多名專注於超低延遲音訊傳輸的專家——這項能力對於在數萬名觀眾面前實現無可察覺延遲的即時語音翻譯同步至關重要。此項交易的財務條款並未公開披露。
Mixhalo 執行長 Vik Singh 表示,他的公司長期以來一直依賴 DeepL 的翻譯引擎作為其主要供應商,因此更深層次的整合是現有合作關係的自然演進。預計結合後的技術將為 DeepL 的即時人工智慧語音翻譯產品 DeepL Voice 提供支援,應用於企業會議、體育場館及全球現場活動。
DeepL 的語音翻譯歷程
DeepL 在擴展到語音音訊之前,已憑藉其頂級的神經文本翻譯引擎建立了聲譽。2024 年,該公司推出了支援超過 33 種語言的語音轉文字翻譯功能。2026 年 4 月(美國東部時間),它推出了一套旨在用於多語言商務會議和遠端協作的語音轉語音翻譯套件。Mixhalo 的收購加速了該路線圖的下一階段:在實體、高觀眾環境中實現即時、大規模、低延遲的語音翻譯。
交易背後的技術
Mixhalo 的核心創新在於其超低延遲的音訊串流架構,旨在同時向場館內數千台行動裝置傳輸同步聲音。當與 DeepL 的神經翻譯模型整合後,此基礎設施能夠提供即時多語言音訊——讓體育場館內的觀眾能在原始語音發出後的幾毫秒內接收到他們偏好語言的語音翻譯。這種延遲效能水平使該整合系統有別於傳統的同步口譯設置,後者通常需要專用的硬體隔間和耳機分發。
新的美國業務據點
作為此次收購的直接成果,DeepL 將在舊金山開設其首個辦事處。此舉擴大了該公司在美國的業務版圖,並使其能夠從灣區招募人工智慧和音訊工程人才。對於這家總部位於德國科隆的公司來說,這是一個重要的里程碑,該公司一直在穩步擴大其全球企業客戶群,現在正在世界頂級科技中心之一紮根。
行業意義
人工智慧語言模型與即時音訊傳輸基礎設施的融合,代表著翻譯行業一個快速增長的領域。大規模即時語音翻譯長期以來一直被認為是一項艱鉅的技術挑戰,不僅需要高翻譯準確度,還需要極其嚴格的時間限制和向數千名同時收聽者進行穩健的傳輸。透過將 Mixhalo 經過驗證的活動串流平台與 DeepL 的翻譯技術相結合,兩家公司正將自己定位為能夠大規模提供無縫多語言體驗——從國際體育賽事和全球音樂巡演,到跨國企業峰會和大型學術會議。