2026년 5월, 엔비디아는 첫 Vera CPU 시스템을 주요 AI 연구소와 클라우드 기업에 전달했다고 밝혔다.
초기 전달 대상은 다음과 같다.
엔비디아 하이퍼스케일·HPC 담당 부사장 이안 벅(Ian Buck) 이 직접 초기 장비를 전달한 것으로 알려졌다.
이 기업들은 Rubin GPU 기반 차세대 AI 인프라를 테스트하는 첫 파트너 그룹에 속한다.
일반적인 서버 CPU가 범용 컴퓨팅을 목표로 하는 것과 달리, Vera는 AI 시스템의 ‘조율 엔진(orchestration engine)’ 역할을 하도록 설계됐다.
최근 AI 워크로드는 단순히 모델에 질문을 던지고 답을 받는 방식에서 벗어나 다음과 같은 복잡한 작업 흐름을 포함한다.
이러한 작업은 GPU의 대규모 행렬 연산뿐 아니라 빠른 메모리 접근과 CPU‑GPU 간 초고속 통신이 중요하기 때문에 Vera가 그 역할을 맡는다.
공개된 정보에 따르면 Vera는 엔비디아가 직접 설계한 Arm 기반 데이터센터 CPU다.
주요 특징은 다음과 같다.
이 구조 덕분에 Vera는 AI 시스템에서 메모리 관리와 작업 조정 역할을 담당하고, 실제 대규모 텐서 연산은 Rubin GPU가 수행하는 방식으로 분업이 이루어진다.
Vera는 엔비디아가 이전 세대 AI 플랫폼에서 사용했던 Grace CPU의 후속 전략으로 볼 수 있다.
엔비디아는 Vera가 특히 에이전틱 AI 워크로드에서 높은 효율을 낸다고 주장한다.
회사 발표에 따르면 Vera 기반 시스템은 다음과 같은 성능 향상을 보일 수 있다.
다만 이러한 수치는 대부분 엔비디아 자체 벤치마크이기 때문에 독립적인 검증은 아직 제한적이다.
Vera CPU는 단독 제품이라기보다 Vera Rubin 플랫폼의 일부로 설계됐다.
대표적인 시스템이 Vera Rubin NVL72 랙이다.
이 시스템에는 다음과 같은 구성 요소가 포함된다.
이 구성은 하나의 랙 전체를 AI 슈퍼컴퓨터처럼 동작하도록 설계된 시스템이다.
또한 엔비디아는 최대 256개의 수랭 Vera CPU를 장착한 CPU 전용 랙도 공개했는데, 이는 에이전트 실행이나 강화학습 같은 CPU 중심 워크로드를 위해 사용된다.
지금까지 엔비디아는 AI 인프라 시장에서 GPU 중심 기업이었다. 하지만 대규모 AI 시스템은 GPU뿐 아니라 CPU, 네트워크, 스토리지, 소프트웨어까지 모두 긴밀히 통합되어야 한다.
Vera CPU는 엔비디아가 단순한 GPU 공급자를 넘어 완전한 AI 인프라 제공 업체로 이동하고 있다는 신호다.
자체 CPU를 통해 엔비디아는 다음을 더 강하게 통제할 수 있다.
결과적으로 AI 데이터센터를 하나의 통합 플랫폼처럼 설계할 수 있게 된다.
Vera의 등장은 엔비디아가 서버 CPU 시장에도 직접 진입했음을 의미한다.
현재 데이터센터 CPU 시장은 Intel Xeon과 AMD EPYC이 중심이다. 특히 AMD는 최근 점유율을 빠르게 확대하고 있다.
예를 들어 Mercury Research 데이터를 인용한 Tom’s Hardware 보도에 따르면 2026년 초 기준 AMD는
까지 상승했다.
엔비디아가 자체 CPU를 도입하면 AI 데이터센터에서 CPU까지 포함한 전체 하드웨어 비용(BOM) 을 더 많이 가져갈 수 있게 된다.
Vera CPU 출시는 AI 컴퓨팅의 큰 흐름도 보여준다.
과거에는 기업들이 CPU, GPU, 네트워크 장비를 각각 구매해 클러스터를 구성했다. 하지만 최신 AI 시스템은 처음부터 하나의 통합 플랫폼으로 설계된 ‘랙 단위 컴퓨터’ 형태로 발전하고 있다.
엔비디아는 이를 AI 팩토리(AI Factory) 라고 부르며, Rubin 세대에서 CPU·GPU·네트워크·DPU·소프트웨어를 하나의 생태계로 묶는 전략을 강화하고 있다.
Vera CPU가 실제 환경에서도 엔비디아의 주장만큼의 성능을 보여준다면, 앞으로 AI 데이터센터는 GPU 중심 클러스터가 아니라 통합형 AI 슈퍼컴퓨터 구조로 발전할 가능성이 높다.