SpaceXAI 推出 Grok 4.6,以半價 API 匹敵 GPT-5.6 Sol

新聞摘要
SpaceXAI,這個隸屬於 Elon Musk 的 SpaceX 旗下、前身為 xAI 的人工智慧集團,於 2026 年 8 月 12 日星期三(美東時間)正式發布其最新的大型語言模型 Grok 4.6。此次發布透過公司官網的官方部落格文章宣布,並獲多家科技媒體確認,將 Grok 4.6 定位為前沿級模型,特別強調長時間運行的自主代理、軟體編碼與複雜知識工作。
發布內容
Grok 4.6 在發布當天即於多個平台同步上線,包括 Grok Build、專注於編碼的 Grok Bot 代理系統、第三方開發者工具 Cursor,以及 xAI API。公司也透過 OpenRouter、Vercel 和 Cloudflare 等基礎設施合作夥伴提供該模型,擴大了開發者將其整合至現有產品的途徑。根據官方公告,Grok 4.6 旨在支援長時間的複雜多步驟任務,無論是跨多個來源研究主題、分析大量資訊、瀏覽完整軟體程式碼庫,或是將粗略想法轉化為完整的應用程式或文件。
模型能力與規格
Grok 4.6 支援 500,000 token 的上下文視窗,並接受文字與圖像輸入,但目前僅輸出文字。該模型對單次回應的輸出長度沒有固定限制,公司表示這旨在支援長篇技術寫作與擴展的代理型工作流程,而不會截斷。與前代 Grok 4.5 相比,新版本反映了更新的監督式微調與基於人類回饋的強化學習,公司將編碼、終端命令執行與一般知識工作基準測試的顯著進步歸功於這些改進。
獨立基準測試結果
第三方評測機構 Artificial Analysis 在其智慧指數中將 Grok 4.6(高)評為 61 分,該指數是涵蓋推理、數學、科學知識與編碼能力等九項個別測試的綜合基準。此分數使 Grok 4.6 與 GPT-5.6 Sol 幾乎持平,略低於 Claude Opus 5 的 63 分與 Claude Fable 5 的 62 分,並領先 Kimi K3。在代理型編碼任務方面,Artificial Analysis 發現 Grok 4.6 平均約在 53 輪對話中解決評測任務,同時平均消耗約 5 億個輸入 token,這比 Claude Opus 5 在類似任務上記錄的約 103 輪對話與 20 億個輸入 token 更為高效。
定價與可用性
SpaceXAI 將 Grok 4.6 的 API 存取定價為每百萬輸入 token 2 美元、每百萬輸出 token 6 美元起,公司與外部報導均稱此費率約為競爭對手實驗室同級前沿模型的一半。Elon Musk 在其社群媒體平台上公開評論此次發布,引用內部 1753 Elo 評分並正面描述此次發布。分析師在報導中指出,接近前沿的基準測試表現與較低的每 token 定價相結合,可能促使競爭對手調整自身的定價結構。
公司路線圖
發布後的報導顯示,SpaceXAI 已在準備一個更大的後繼模型,暫稱為 Grok 4.7,預計規模將擴展至約 2.1 兆個參數,並在 Grok 4.6 發布後數週內推出。報導也指出內部目標是在 2026 年底前發布下一代 Grok 5 模型,顯示公司計劃在今年剩餘時間內維持快速的發布節奏。
更廣泛的產品背景
除了核心模型發布外,SpaceXAI 也推出了 Grok Bot,這是一個面向企業的系統,旨在協調銷售、財務與工程等部門的多個 AI 代理。該工具讓代理之間能共享上下文並互相交接任務,其設計目標是自動化多步驟的商業工作流程,而非處理單一、孤立的請求。業界觀察家將 Grok Bot 視為 SpaceXAI 對其他主要 AI 實驗室正在開發的同類企業代理產品的回應,反映了整個產業正轉向能在更長、更複雜的工作流程中半自主運作的 AI 系統。