/ 뉴스 / 엔비디아, 앤트로픽, 오픈AI, 오라클에 첫 맞춤형 CPU 직접 전달 — 베라 시대 개막
엔비디아

엔비디아, 앤트로픽, 오픈AI, 오라클에 첫 맞춤형 CPU 직접 전달 — 베라 시대 개막

May 19, 20261 분 소요
엔비디아, 앤트로픽, 오픈AI, 오라클에 첫 맞춤형 CPU 직접 전달 — 베라 시대 개막

뉴스 요약

NVIDIA가 자체 설계한 최초의 맞춤형 CPU인 Vera CPU를 주요 AI 연구소에 공식적으로 공급하기 시작하며, 에이전트 AI 시대로의 전환에 있어 중요한 이정표를 세웠습니다. 2026년 5월 중순, NVIDIA는 Anthropic, OpenAI, SpaceXAI, Oracle Cloud Infrastructure에 초기 물량을 직접 전달하며 칩의 대량 생산이 본격화되었음을 알렸습니다.

NVIDIA Vera CPU란 무엇인가?

Vera CPU는 NVIDIA가 에이전트 AI 워크로드의 요구 사항을 충족하기 위해 처음부터 전면적으로 맞춤 설계한 중앙 처리 장치입니다. 에이전트 AI는 AI 모델이 장기간에 걸쳐 추론, 계획, 정보 검색 및 자율적인 행동을 수행해야 하는 시스템을 의미합니다. 학습 중심의 가속기와 달리 Vera는 에이전트 애플리케이션에 필요한 지속적이고 지연 시간에 민감한 추론 파이프라인에 최적화되어 있습니다.

각 Vera CPU 다이에는 Olympus라는 코드명을 가진 88개의 CPU 코어가 탑재되어 있으며, ARM v9.2-A 아키텍처를 구현합니다. 이 설계는 동시 멀티스레딩(SMT) 기능을 지원하며, NVIDIA의 독자적인 공간 멀티스레딩 기술을 통해 176개의 스레드를 처리할 수 있습니다. 이전 세대인 Grace CPU와 비교했을 때 Vera는 성능 효율성이 두 배 향상되었으며, 에이전트 추론 벤치마크에서 기존의 랙 규모 CPU보다 약 50% 더 빠른 속도를 제공합니다.

역사적인 첫 배송

NVIDIA의 하이퍼스케일 및 고성능 컴퓨팅 부문 부사장인 Ian Buck은 2026년 5월 중순 금요일(태평양 시간)에 세계 최고 AI 연구 기관 중 세 곳인 샌프란시스코의 Anthropic, 미션 베이(샌프란시스코)의 OpenAI, 팔로알토의 SpaceXAI에 직접 Vera CPU 시스템을 전달했습니다. 산타클라라에 위치한 Oracle Cloud Infrastructure(OCI)는 다음 월요일 아침(태평양 시간)에 배송을 받았습니다.

Anthropic에서는 컴퓨팅 책임자인 James Bradbury가 샌프란시스코 만이 내려다보이는 회의실에서 인수를 받았습니다. Buck은 Bradbury에게 새로운 프로세서를 중심으로 구축된 서버 아키텍처를 설명했습니다. Bradbury는 "에이전트 워크로드 해결에 있어 Vera가 유망한 생태계의 일부로 등장하는 것을 보게 되어 기쁩니다."라고 말했습니다.

OpenAI에서는 컴퓨팅 인프라 책임자인 Sachin Katti가 직접 배송을 받고 Buck에게 시스템을 사무실까지 직접 가져다준 것에 대해 감사를 표했습니다.

아키텍처 및 플랫폼 컨텍스트

Vera CPU는 NVIDIA의 광범위한 Vera Rubin 플랫폼의 핵심 구성 요소입니다. 이 플랫폼은 2026년 1월 CES에서 발표되었으며 2026년 GTC(2026년 3월, 태평양 시간)에서 더 자세히 설명되었습니다. Vera Rubin 플랫폼은 NVIDIA의 AI 컴퓨팅 스택을 완전히 재설계한 것으로, 다음을 결합합니다.

  • Vera CPU: 오케스트레이션 및 에이전트 추론에 최적화된 88코어 ARM 기반 프로세서
  • Rubin GPU 아키텍처: HBM4 메모리를 갖춘 차세대 그래픽 처리 장치
  • NVLink 6 상호 연결: 초고대역폭 칩 간 및 시스템 간 통신 패브릭
  • 통합 Groq 추론 가속기: 저지연 토큰 생성을 위해 시스템에 긴밀하게 통합됨

NVIDIA CEO인 Jensen Huang은 2026년 GTC에서 최초의 완전한 Vera Rubin 랙이 이미 Microsoft Azure에서 운영 중이며, 클라우드 고객에게 플랫폼 기능을 평가할 수 있는 조기 액세스를 제공한다고 확인했습니다.

생산 규모 및 상업적 가용성

Vera는 현재 전면 생산 중입니다. NVIDIA와 계약 제조 파트너인 Foxconn, Quanta, Wistron은 시스템 및 랙 조립을 신속하게 확장하고 있으며, 대규모 출하는 2026년 3분기(2026년 7월 1일 동부 시간 시작)를 목표로 하고 있습니다.

OCI는 기업 및 클라우드 고객 전반에 걸쳐 에이전트 AI 워크로드 수요의 끊임없는 증가를 이유로 2026년부터 수십만 개의 Vera CPU를 배포하기로 약속했습니다. Vera 기반 시스템은 2026년 하반기에 Cisco, Dell, HPE, Lenovo, Supermicro를 포함한 주요 OEM 파트너를 통해 상업적으로 이용 가능해질 것입니다.

에이전트 AI가 전용 CPU를 필요로 하는 이유

기존 AI 인프라는 학습 또는 배치 추론이 컴퓨팅 프로파일을 지배하는 GPU 중심 파이프라인을 중심으로 구축되었습니다. 에이전트 AI는 이러한 방정식을 바꿉니다. 에이전트는 지속적으로 실행되고, 빠른 순차적 결정을 내리며, 대규모 컨텍스트 창을 관리하고, 외부 도구를 호출하며, 하위 작업을 오케스트레이션합니다. 이 모든 것은 시스템 메모리 대역폭, I/O 처리량 및 CPU 측 오케스트레이션 로직에 상당한 부담을 줍니다.

NVIDIA는 이러한 병목 현상을 해결하기 위해 Vera를 특별히 설계했습니다. 이 칩의 높은 코어 수, 확장된 메모리 대역폭, NVIDIA의 NVLink 패브릭과의 깊은 통합은 수천 개의 GPU 가속기를 효율적으로 조정해야 하는 대규모 AI 공장에서 "명령 및 제어" 역할을 수행하는 데 매우 적합합니다.

산업적 중요성

이번 배송은 NVIDIA가 자체 설계한 CPU를 출하한 첫 사례로, 하드웨어 포트폴리오를 GPU 및 네트워킹 칩을 넘어 확장했습니다. 분석가들은 이를 고객에게 완전히 통합된 NVIDIA 최적화 컴퓨팅 스택을 제공하여 타사 CPU에 대한 의존도를 줄이고 처리, 메모리 및 상호 연결 계층 간의 긴밀한 공동 설계를 가능하게 하는 전략적 움직임으로 보고 있습니다.

Vera CPU 배송은 또한 상업적 워크로드 범주로서 에이전트 AI의 빠른 성숙을 강조합니다. 첫 생산 실행부터 Anthropic, OpenAI, SpaceXAI, OCI와의 파트너십은 전용 AI 인프라가 차세대 대규모 AI 배포를 정의할 것이라는 강력한 업계 신뢰를 보여줍니다.

엔비디아AI 하드웨어