首頁 / 資訊 / Claude Opus 4.8 登場,帶來 1,000 個子代理協調能力以及智慧程度提升 4 倍的程式碼審閱器
Anthropic

Claude Opus 4.8 登場,帶來 1,000 個子代理協調能力以及智慧程度提升 4 倍的程式碼審閱器

May 29, 20261 分鐘閱讀
Claude Opus 4.8 登場,帶來 1,000 個子代理協調能力以及智慧程度提升 4 倍的程式碼審閱器

新聞摘要

Anthropic 於太平洋時間 2026 年 5 月 28 日發布了 Claude Opus 4.8,在代理編碼、自主推理和營運透明度方面取得了重大進展 — 同時還推出了兩項重要的平台新增功能:動態工作流程和速度更快、成本更低的快速模式。

什麼是 Claude Opus 4.8

Claude Opus 4.8 是 Anthropic 最新的旗艦語言模型,接替了 Claude Opus 4.7。它已於太平洋時間 2026 年 5 月 28 日在 Claude API、Amazon Bedrock、Google Cloud Vertex AI 和 Microsoft Foundry 上立即提供。定價與 Opus 4.7 保持不變,對於現有客戶而言,升級成本中性。

Anthropic 將該模型描述為具有「更敏銳的判斷力、對其進展更誠實的態度,以及比其前代產品更長時間獨立工作的能力」。在測試中,Opus 4.8 允許有缺陷的生成程式碼未經標記通過的可能性,比其前代產品低約四倍 — 這對於依賴 AI 輔助軟體工程的開發人員來說是一項關鍵改進,因為未檢測到的錯誤會產生下游成本。

基準改進

Claude Opus 4.8 在 Anthropic 追蹤的每個主要評估類別中均有所提升:

  • 代理編碼分數:64.3% → 69.2%
  • 使用工具的多學科推理:54.7% → 57.9%
  • 代理電腦使用:82.8% → 83.4%
  • 知識工作分數:1,753 → 1,890

這些提升反映了一個模型能夠在較少的人工監督下執行複雜的多步驟任務 — 這是 Anthropic 當前開發軌跡的關鍵優先事項,也是對企業工程團隊需求的直接回應。

動態工作流程:協調大規模任務

與 Opus 4.8 一同推出的主要功能之一是動態工作流程,目前處於研究預覽階段。此功能允許 Claude 編寫協調腳本,該腳本可以啟動和管理數十到數百個並行子代理,使其能夠從啟動到完成處理程式碼庫規模的任務。

該系統每個運行最多限制 16 個並行子代理和 1,000 個總子代理。實際上,這意味著 Claude Code 中的 Opus 4.8 現在可以使用專案現有的測試套件作為其品質基準,從初始啟動到可合併的拉取請求,執行跨越數十萬行程式碼的完整程式碼庫遷移。

這使得 Claude Opus 4.8 成為最能幹的 AI 編碼代理之一,適用於管理大型程式碼庫或執行大規模架構變更而無需手動協調開銷的工程團隊。

快速模式:速度快 2.5 倍,成本便宜 3 倍

Anthropic 為 Opus 4.8 大幅升級了快速模式。該模式現在提供的回應速度比標準推理快約 2.5 倍,並且成本已降低到先前 Opus 模型快速模式成本的大約三分之一。快速模式的定價為每百萬輸入 token 10 美元,每百萬輸出 token 25 美元。

模型選擇器附帶了一個新的「努力控制」設定,讓使用者可以調整 Claude 在任務上投入的計算量。Opus 4.8 預設為「高努力」,Anthropic 認為這是大多數工作負載下回應品質和使用者體驗的最佳平衡。

可用性和整合

截至太平洋時間 2026 年 5 月 28 日,可透過以下方式存取 Claude Opus 4.8:

  • Claude API — 為開發人員和平台建構者提供直接存取
  • Amazon Bedrock — 整合到 AWS 基礎設施中,用於企業部署
  • Google Cloud Vertex AI — 在 GCP 的託管 AI 服務中可用
  • Microsoft Foundry — 可透過 Microsoft 的 AI 開發平台存取

對於已經在生產環境中運行 Opus 4.7 的團隊,無需進行遷移步驟。模型識別碼已更新,並且定價保持一致,從而降低了採用門檻。

下一步:Mythos 級模型

Anthropic 確認,新一代「Mythos 級」模型正在開發中,並將於「未來幾週內」發布。目前尚未披露有關架構、功能基準或定價的更多細節。此公告表明 Opus 4.8 是一個短期過渡,而不是一個長週期旗艦版本,延續了 Anthropic 在 2025 年和 2026 年加速的模型更新步伐。

AnthropicAI 模型