Arena 以 31 億美元估值完成 2 億美元融資,十個月內價值近乎翻倍

新聞摘要
根據 TechCrunch 報導,源自 UC Berkeley 研究專案的群眾協作式 AI 模型排行榜平台 Arena,於 2026 年 10 月 8 日星期四宣布以 31 億美元估值完成 2 億美元 B 輪融資。此輪融資距離該公司 2026 年 1 月以 17 億美元投後估值完成的 1.5 億美元 A 輪融資僅約十個月,意味著其價值在不到一年內幾乎翻倍。
投資方是誰
本輪 B 輪融資由 Lightspeed Venture Partners 與 Khosla Ventures 領投。TechCrunch 報導中提及的其他參與者包括 Salesforce Ventures、01 Advisors、Dell Technologies Capital、Endeavor Catalyst、a16z 與 Felicis。該報導於太平洋時間 2026 年 10 月 8 日上午 11:19 發布,並未點名 Arena 的個別高階主管。先前關於一月那輪融資的報導指出,該輪由 Felicis 與 UC Investments 領投,且在本輪之前的累計融資金額約為 2.5 億美元;這些早期數據來自二手來源,讀者應留意此一背景。
從研究專案到商業平台
Arena 於 2023 年起源於 UC Berkeley 的一項學術計畫,透過人類偏好投票來評比 AI 模型。其公開排行榜免費使用:訪客可輸入提示詞,或要求生成小型的「氛圍編程」專案,比較不同模型的回應,並投票選出表現較佳者。該公司表示,網站每月吸引數千萬名訪客,這為其提供了龐大且持續更新的人類判斷資料庫。
2025 年 9 月,Arena 推出商業產品 AI Evaluations,為模型開發者與企業提供基於社群回饋的詳細效能分析。該產品正是公司營收成長的基礎。
營收成長
2026 年 1 月 A 輪融資完成時,其年化營收約為 3,000 萬美元。2026 年 6 月,Arena 表示其年化營收已達 1 億美元,距離推出企業級服務僅約八個月。據其他媒體報導,公司管理層曾表示,此數字反映的是按使用量計費的收入,而非傳統軟體定義下的年度經常性營收。
全新聚焦 AI 對齊
除了融資消息外,Arena 也在排行榜中新增了對齊類別。該類別針對三項行為對模型進行排名:未經授權的操作、錯誤歸因以及「欺騙性完成」。根據 TechCrunch 報導,在初步的對齊排名中,OpenAI 的模型位居前列,而 Anthropic 的 Claude Opus 5.5 排名第六,Claude Fable 排名第九。
Arena 認為,一旦模型察覺自己正在接受測試,固定基準測試就會失去價值。用他們的話說:「當模型意識到自己正在被測試時,靜態基準測試便會失效」,而且「世界需要一個中立的第三方,來衡量 AI 實際上有多安全、多符合對齊標準。」
為何重要
隨著 AI 模型數量激增且快速進步,開發者、企業與學生都需要可信賴的方式來比較它們。Arena 依賴大規模人類偏好資料而非固定測試集的做法,如今已成為備受關注的參考指標。新一輪融資顯示,投資人將獨立評估視為 AI 生態系中持久的一環;而對齊排名的推出,則代表關注焦點正從純粹的能力,擴展至安全與誠實行為等議題。
查證說明
上述融資細節來自 TechCrunch 於 2026 年 10 月 8 日的報導。截至撰稿時,獨立網路搜尋尚未找到關於這輪 31 億美元融資的其他佐證,不過先前的營收與 A 輪數據已獲其他媒体證實。在 Arena 或其他媒體確認之前,讀者應將 B 輪數據視為單一來源的報導。
本文由 AIBARS 編輯部在 AI 輔助下整理。AI 可能出錯,重要資訊請以原始來源為準。發現錯誤?請來信 [email protected]。