首頁 / 資訊 / 輝達親手交付其首款客製化 CPU 給 Anthropic、OpenAI 和 Oracle — Vera 時代開啟
輝達

輝達親手交付其首款客製化 CPU 給 Anthropic、OpenAI 和 Oracle — Vera 時代開啟

May 19, 20261 分鐘閱讀
輝達親手交付其首款客製化 CPU 給 Anthropic、OpenAI 和 Oracle — Vera 時代開啟

新聞摘要

輝達(NVIDIA)已正式開始向頂尖的 AI 研究機構交付其首款客製化 CPU — Vera CPU — 這標誌著公司邁向自主 AI 時代的關鍵里程碑。在 2026 年 5 月中旬,輝達親自將首批 Vera CPU 交付給 Anthropic、OpenAI、SpaceXAI 和 Oracle Cloud Infrastructure,這表明該晶片的規模化生產已全面展開。

什麼是 NVIDIA Vera CPU?

Vera CPU 是輝達首款完全客製化設計的中央處理器,專為自主 AI 工作負載的需求而從頭打造。自主 AI 系統是指 AI 模型必須在長時間內自主進行推理、規劃、檢索資訊並採取行動。與專注於訓練的加速器不同,Vera 針對自主應用程式所需的持續、對延遲敏感的推理流程進行了優化。

每個 Vera CPU 晶片包含 88 個代號為 Olympus 的 CPU 核心,採用 ARM v9.2-A 架構。該設計支援同步多執行緒(SMT),透過輝達專有的空間多執行緒技術可支援 176 個執行緒。與其前代產品 Grace CPU 相比,Vera 在效能效率方面提升了一倍,並且在自主推理基準測試中,其速度比傳統機架級 CPU 快約 50%。

歷史性的首次交付

輝達超大規模運算與高效能運算副總裁 Ian Buck 於 2026 年 5 月中旬的某個星期五(太平洋時間),親自將首批 Vera CPU 系統交付給了全球三大頂尖 AI 研究組織:位於舊金山的 Anthropic、位於舊金山灣區的 OpenAI,以及位於帕洛阿爾托的 SpaceXAI。Oracle Cloud Infrastructure (OCI) 位於聖克拉拉,於次週一上午(太平洋時間)收到了交付。

在 Anthropic,該公司計算主管 James Bradbury 在一間俯瞰舊金山灣的會議室中接受了交付。Buck 向 Bradbury 介紹了圍繞新處理器構建的伺服器架構。Bradbury 表示:「我們很高興看到 Vera 在解決自主工作負載方面,成為生態系統中有前景的一部分。」

在 OpenAI,計算基礎設施主管 Sachin Katti 親自接收了交付,並感謝 Buck 將系統直接送到他們的辦公室。

架構與平台背景

Vera CPU 是輝達更廣泛的 Vera Rubin 平台的核心組件,該平台於 2026 年 1 月的 CES 上發布,並於 2026 年 GTC(2026 年 3 月,太平洋時間)上進一步詳述。Vera Rubin 平台代表了輝達 AI 計算堆疊的全面重新設計,結合了:

  • Vera CPU — 88 核心 ARM 架構處理器,專為協調和自主推理進行優化
  • Rubin GPU 架構 — 採用 HBM4 記憶體的新一代圖形處理單元
  • NVLink 6 互連 — 超高頻寬的晶片對晶片和系統對系統通訊架構
  • 整合式 Groq 推理加速器 — 與系統緊密耦合,實現低延遲的 token 生成

輝達執行長 Jensen Huang 在 2026 年 GTC 上確認,首個完整的 Vera Rubin 機架已在 Microsoft Azure 上運行,為雲端客戶提供了早期評估平台功能的機會。

生產規模與商業上市

Vera 現已全面投入生產。輝達及其合約製造夥伴 — 富士康、廣達和緯創 — 正在迅速擴大系統和機架的組裝規模,大規模出貨目標鎖定在 2026 年第三季度(第三季度始於美國東部時間 2026 年 7 月 1 日)。

OCI 已承諾從 2026 年開始部署數十萬顆 Vera CPU,並指出企業和雲端客戶對自主 AI 工作負載的需求持續增長。Vera 系統將於 2026 年下半年開始,透過包括 Cisco、Dell、HPE、Lenovo 和 Supermicro 在內的主要 OEM 合作夥伴進行商業銷售。

為何自主 AI 需要專用 CPU

傳統 AI 基礎設施圍繞著以 GPU 為中心的流程構建,其中訓練或批次推理主導著計算配置。自主 AI 改變了這種情況。自主代理程式持續運行,快速做出連續決策,管理大型上下文視窗,調用外部工具,並協調子任務 — 所有這些都對系統記憶體頻寬、I/O 吞吐量和 CPU 端協調邏輯提出了嚴峻的要求。

輝達專門設計 Vera 來解決這些瓶頸。該晶片的高核心數量、擴展的記憶體頻寬以及與輝達 NVLink 架構的深度整合,使其非常適合在大型 AI 工廠中扮演「指揮與控制」的角色,這些工廠需要高效協調數千個 GPU 加速器。

行業意義

此次交付標誌著輝達首次出貨完全自主設計的 CPU,將其硬體產品組合從 GPU 和網路晶片擴展開來。分析師認為這是一項策略性舉措,旨在為客戶提供完全整合、輝達優化的計算堆疊 — 減少對第三方 CPU 的依賴,並實現處理器、記憶體和互連層之間的更緊密協同設計。

Vera CPU 的交付也凸顯了自主 AI 作為商業工作負載類別的快速成熟。在首次生產階段就與 Anthropic、OpenAI、SpaceXAI 和 OCI 建立合作夥伴關係,表明業界對專用 AI 基礎設施將定義下一波大規模 AI 部署的強烈信心。

輝達AI 硬體