首頁 / 資訊 / Google 推出 Gemini 4 Argon,員工同步測試據稱可媲美 Opus 5.5 的 Carbon 版本
Gemini 4

Google 推出 Gemini 4 Argon,員工同步測試據稱可媲美 Opus 5.5 的 Carbon 版本

2026年10月10日4 分鐘閱讀
Google 推出 Gemini 4 Argon,員工同步測試據稱可媲美 Opus 5.5 的 Carbon 版本

新聞摘要

Google 正準備將內部代號為 Argon 的全新 Gemini 4 模型開放給更多使用者,同時員工已在試用名為 Carbon 的更新版內部檢查點;部分測試人員認為這是明顯的進步,尤其在程式開發方面。這些細節出自 Business Insider 根據內部文件與員工對話所撰寫的報導,本文亦交叉比對了其他媒體對該報導及相關消息的二次轉述。由於無法直接開啟 Business Insider 的原文,以下部分資訊來自內容聚合平台,應視為二手消息。

Google 已宣布的內容

Google 於 2026 年 9 月 30 日宣布推出 Gemini 4 Argon。公開報導僅提及日期而未註明具體時間,因此無法提供特定時區的確切時間戳記。此模型透過名為 Fairwind 的計畫,率先開放給部分網路安全專家使用。付費 API 客戶與 Google AI Ultra 訂閱者預計將是下一批使用者,但 Google 尚未公布更廣泛開放的日期。

Google 也表示,已有數千名自家員工在內部使用該模型處理專門的程式開發、研究與寫作任務。

員工正在測試的內容

根據其他媒體轉述的 Business Insider 報導,員工一直在試用暱稱為 Carbon 的較新 Gemini 4 版本。該報導描述了一條內部命名脈絡,其中包含一個名為 Barium-B 的模型,據悉該模型被選定為後來對外公開的 Argon。Carbon 似乎是同一個 Gemini 4 系列中較晚期的檢查點,而非用來取代 Argon。

一名測試人員表示,Carbon 在程式開發上「感覺就像 Opus 5.5」,指的是 Anthropic 的 Claude Opus 5.5,但也補充說仍需更多測試。部分報導將 Carbon 描繪為透過遞迴自我改進式訓練而逼近 Opus 5.5 的水準,不過這種說法源自內容聚合平台,尚未獲得 Google 證實。

Argon 目前的表現

早期的獨立測試顯示,Argon 在 Artificial Analysis Intelligence Index 中得分為 53,與 OpenAI 的 GPT-6 Astra 持平。Claude Opus 5.5 仍以 58 分領先該指數。報導也指出,在這些早期測試中,Argon 產生幻覺的情況明顯少於同級模型。

另據二次轉述的 Bloomberg 報導指出,部分 Google 員工對 Argon 的實際應用表現抱持懷疑態度。他們形容該模型在業界標準基準測試中成績亮眼,但在某些程式開發任務上的結果卻較為薄弱。有兩人表示,該模型似乎受到「刷榜」(benchmaxxing)影響,也就是針對測試分數進行最佳化,而非著重日常實用性。Google 向 Bloomberg 表示,若說該模型在程式開發等領域表現不佳並不準確。

仍未知的事項

Google 尚未證實 Carbon 是否作為產品存在、是否會正式推出,或將以何種名稱問世。目前也不清楚 Carbon 會以 Argon 的名義作為更新推出,還是成為 Gemini 4 家族中的獨立模型。由於尚未公布任何針對 Carbon 的獨立基準測試,內部測試人員的評論仍僅屬個人經驗之談。

為何重要

如今前沿模型的發布皆採分階段檢查點的方式推進,搭配內部代號、有限的早期存取與快速迭代。基準測試分數與實際操作可用性之間的落差(尤其是在程式開發方面),正逐漸成為開發者評估新模型的關鍵依據。在 Carbon 的獨立評測出現之前,讀者應將內部測試人員的印象視為早期訊號,而非經過驗證的效能表現。

本文由 AIBARS 編輯部在 AI 輔助下整理。AI 可能出錯,重要資訊請以原始來源為準。發現錯誤?請來信 [email protected]。

Gemini 4Google AI