NVIDIA가 AI 생태계의 파트너들에게 Vera 시스템을 출하하기 시작했다. 이는 맞춤형 중앙처리장치가 발표 단계를 넘어 클라우드 제공업체와 모델 개발 연구소에서 평가 및 배포 단계로 진입했음을 의미한다. 납품 대상에는 AWS와 Oracle Cloud Infrastructure뿐 아니라 Anthropic, OpenAI 및 SpaceXAI도 포함됐다. NVIDIA는 이 자료를 2026년 5월 18일 공개한 뒤 2026년 8월 27일 업데이트했으며, Vera 출하가 확대되는 규모로 진행되고 있다고 설명했다.
GPU만으로 수행되지 않는 작업을 위한 프로세서
NVIDIA는 Vera를 자사의 첫 맞춤형 중앙처리장치이자 처음부터 에이전틱 AI 워크로드를 위해 구축된 프로세서로 제시한다. 회사는 이러한 워크로드가 GPU를 통한 모델 실행에만 국한되지 않고, 격리된 환경 실행, 도구 호출, 실행 단계 관리, 긴 컨텍스트에서의 정보 검색, 시스템 구성 요소 간 데이터 전송을 포함한다고 설명한다.
NVIDIA의 사양에 따르면 Vera는 회사가 설계한 Olympus 코어 88개와 초당 1.2테라바이트의 메모리 대역폭을 갖춘다. NVIDIA는 이 프로세서가 자사가 사용하는 기준 시스템과 비교해 에이전틱 AI 워크로드에서 코어당 최대 1.8배의 성능을 제공한다고 말하며, 가속기와 통합된 아키텍처가 기존 아키텍처보다 최대 2배 높은 전력 효율을 제공할 수 있다고도 밝혔다. 이는 회사가 제시한 수치이며, 자료에는 테스트 방법론이나 비교에 사용된 경쟁 시스템에 관한 세부 정보가 포함되지 않았다.
누가 시스템을 공급받았으며 무엇을 평가하고 있는가?
AWS는 양사가 16년에 걸친 협력의 확대를 발표한 가운데, 시애틀 본사에서 첫 Vera 서버와 첫 Vera Rubin GPU 시스템을 인수했다. 공개된 계획에는 NVIDIA GPU 200만 개를 추가하고 Vera 기반 아키텍처를 AWS에 도입하는 작업이 포함된다.
Oracle Cloud Infrastructure는 2026년부터 Vera 프로세서 수십만 개를 배포할 계획이라고 밝혔으며, NVIDIA를 Vera를 초대규모로 배포하는 첫 번째 클라우드 제공업체라고 표현했다. 그러나 자료는 이러한 시스템이 제공될 클라우드 리전이나 구체적인 일정에 관한 정보를 제시하지 않는다.
SpaceXAI는 강화학습 워크로드와 에이전트 기반 시뮬레이션 경로를 대상으로 프로세서를 평가하고 있다. Anthropic과 OpenAI도 초기 납품 과정에서 시스템을 검토했으며, Anthropic은 컴퓨팅 용량 확대가 모델 성장을 가속할 수 있다고 언급했지만 자료에는 독립적인 테스트 결과가 공개되지 않았다.
NVIDIA 플랫폼 내 Vera의 위치
NVIDIA는 Vera를 단순한 독립형 프로세서가 아니라 Rubin GPU, BlueField-4 DPU, Spectrum-X 네트워크 및 MGX 랙 아키텍처를 포함하는 생태계의 일부로 제시한다. Vera Rubin NVL72 시스템에서 Vera는 한 쌍의 Rubin GPU를 위한 호스트 프로세서로 작동하며, 통합 메모리 아키텍처에서 2세대 NVLink-C2C를 통해 GPU와 연결된다.
실제로 NVIDIA는 중앙처리장치가 GPU의 지속적인 활용을 제한할 수 있는 제어, 조정 및 데이터 전송 작업을 처리할 수 있다고 기대하고 있다. 이는 클라우드 운영자와 에이전트 모델 개발자에게 중요한데, 이러한 보조 작업의 속도가 높아지면 추론 속도뿐 아니라 응답 시간과 각 작업의 운영 비용에도 영향을 줄 수 있기 때문이다.
아직 확정되지 않은 사항은 무엇인가?
출하 시작은 Vera가 주요 파트너들의 실제 시스템에 도입되는 단계로 넘어갔다는 증거이지만, 이것만으로 모든 에이전트 워크로드에서 광범위한 실질적 우위를 입증하는 것은 아니다. 출처는 주로 NVIDIA의 사양과 주장에 의존하며, 서버 가격, 상용 공급 조건 또는 고객이 공개한 비교 결과는 언급하지 않는다. 또한 OCI가 밝힌 향후 대규모 배포는 아직 발표된 계획에 해당하며, Vera의 실제 가치는 다양한 모델 유형, 도구 사용 경로 및 클라우드 아키텍처를 대상으로 한 독립적인 평가를 거쳐야 확인될 것이다.