편집자 주: 이 글은 2026년 5월 18일에 처음 게시됐으며, 2026년 8월 27일 목요일에 업데이트됐습니다.
AWS와 NVIDIA는 어제 16년에 걸친 협력을 대폭 확대한다고 발표했습니다. NVIDIA GPU 200만 개를 추가로 공급하고, Vera CPU 기반 인프라를 AWS에 도입하는 작업이 여기에 포함됩니다.
AWS는 첫 NVIDIA Vera CPU 서버와 Vera Rubin GPU를 받았습니다. NVIDIA 하이퍼스케일·HPC 부문 부사장 Ian Buck이 시애틀에서 직접 전달했습니다.
AWS는 AI 생태계를 빠르게 누비고 있는 Vera의 최신 목적지입니다. 앞서 Buck은 Oracle Cloud Infrastructure와 Anthropic, OpenAI, SpaceXAI 등 선도적인 AI 연구소 세 곳에 Vera CPU 시스템을 전달했습니다.
Buck은 “에이전틱 AI가 AI 팩토리에서 CPU의 시대를 새로 열고 있다”며 “모델이 답하는 것에서 행동하는 것으로 옮겨 가는 지금, Vera는 그 작업이 대규모로 계속 돌아가도록 설계된 CPU”라고 말했습니다.
핵심은 이렇습니다. 당신이 지금보다 10배 빠르게 일할 수 있다고 상상해 보세요. 당신의 컴퓨터가 그 속도를 따라올 수 있을까요? 에이전틱 AI는 슬라이드 제작부터 소프트웨어 컴파일과 테스트, 데이터 분석, 파일 검색, 심지어 시뮬레이션 실행까지 온갖 업무에 쓰이는 인프라에 그 어느 때보다 큰 부담을 지웁니다.
AI 에이전트는 GPU만으로 돌아가지 않습니다. 에이전트 샌드박스 하나하나, 도구 호출 하나하나, 오케스트레이션 계층, 긴 컨텍스트 검색 연산 모두가 CPU의 몫입니다. Vera는 바로 이 현실을 출발점으로 삼아 설계된 새로운 부류의 CPU입니다.
동시다발적으로 쏟아지는 실시간 작업의 관문은 CPU에 부담을 주는데, 이는 코어 밀도 위주로 설계된 기존 CPU가 애초에 우선순위로 삼지 않았던 종류의 부담입니다. Vera는 NVIDIA가 직접 설계한 Olympus 코어 88개와 1.2TB/s의 메모리 대역폭을 갖췄고, 에이전틱 AI 워크로드에서 최대 1.8배 빠른 코어당 성능을 제공합니다. 부하가 계속되는 상황에서도 작업이 더 빨리 끝나기 때문에 AI 팩토리 전체의 효율이 올라가고, 사용자는 더 빠른 응답으로 일을 마칠 수 있습니다.
NVIDIA Vera is heading to @awscloud.
NVIDIA’s Ian Buck hand-delivered AWS’s first Vera CPU Server and Vera Rubin GPU to Willem Visser and Supreeth Sheshadri at the AWS HQ in Seattle.
Vera is purpose-built for agentic AI: more tokens per dollar, faster results for users, and…
— NVIDIA (@nvidia) 2026년 8월 27일
Buck은 시애틀의 스피어스(Spheres)를 지나 AWS의 첫 Vera CPU 서버와 Vera Rubin GPU를 밀고 가, AWS의 Amazon EC2 부문 부사장 Willem Visser에게 전달했습니다. Amazon EC2 하드웨어 엔지니어링 부문 부사장 Supreeth Sheshadri도 함께해, Vera와 Vera Rubin이 AWS 고객에게 무엇을 가져다줄지 자세히 이야기를 나눴습니다.
NVIDIA’s Ian Buck hand-delivered the first-ever NVIDIA Vera CPUs to our partners @AnthropicAI, @OpenAI, @SpaceX, and @OracleCloud. 🎉
Vera is NVIDIA’s first custom CPU, purpose-built for the age of agentic AI. This is just the beginning. The road to Vera-powered systems starts…
— NVIDIA (@nvidia) 2026년 5월 18일
Oracle AI Customer Excellence Center에서는 전체 제품 관리를 이끄는 Karan Batta와 최고 고객·파트너 성공 책임자 Gary Miller를 비롯한 OCI 팀이 포장을 푼 Vera CPU 시스템을 살펴봤습니다. 그 뒤편에서는 NVIDIA GPU 랙이 전 세계 OCI 고객 워크로드를 돌리고 있었습니다. 이곳은 Oracle 고객들이 다양한 AI 워크로드를 직접 굴려 보는 공간입니다.
Buck은 Vera가 어떤 도움이 되는지 설명했습니다.
Buck은 Vera CPU가 특히 잘하는 작업을 설명하며 “AI 모델에 질문을 던지면 답이 이미 준비돼 있는 경우는 드물다. 모델은 정답에 이르기 위해 실제로 Python 코드를 생성해야 한다”며 “CPU 수요가 급증하는 이유가 여기에 있다”고 말했습니다.
OCI 팀도 같은 흐름을 목격하고 있었습니다.
Batta는 “에이전틱 AI는 대규모 환경에서 지속적인 성능을 요구하기 때문에, OCI는 2026년부터 수십만 개의 NVIDIA Vera CPU를 배포할 계획”이라며 “Vera의 아키텍처는 높은 처리량이 필요한 추론 워크로드를 위해 설계돼, OCI가 차세대 엔터프라이즈 AI를 구동하는 데 필요한 효율과 집적도, 그리고 알맞은 설치 공간을 제공한다”고 말했습니다.
OCI는 Vera를 하이퍼스케일 규모로 배포하는 첫 클라우드 사업자입니다. 기업 고객에게 이는 오늘날 어떤 클라우드 사업자도 따라올 수 없는 규모의 프로덕션급 에이전틱 AI 인프라를 뜻합니다.
Miller는 OCI 팀이 Vera를 빨리 활용하고 싶어 하며, 고객이 자사의 에이전틱 AI와 워크로드를 맞춤 구성하고 검증할 또 하나의 시스템을 제공하게 됐다고 말했습니다. 그는 “이곳을 찾는 분들이 어떤 반응을 보일지, 그리고 함께 Vera를 최대한 활용해 나갈 일이 정말 기대된다”고 덧붙였습니다.
5월, 그날의 마지막 AI 연구소 전달은 팰로앨토에 있는 SpaceXAI 사무실에서 이뤄졌습니다.
NVIDIA 팀이 Elon Musk에게 시스템 내부를 안내했습니다. Musk는 설명을 듣더니 질문을 쏟아내기 시작했습니다. 코어에 대해, 메모리 구성에 대해, 냉각에 대해.
SpaceXAI는 강화 학습 워크로드와 자사 학습 스택을 구동하는 에이전트 기반 시뮬레이션 파이프라인에 Vera를 도입하는 방안을 검토하고 있습니다.
OpenAI의 미션베이 본사에서는 전달식이 야외로 옮겨졌습니다. 본사 사무실에 딸린 옥외 발코니였습니다.
변덕스럽기로 유명한 샌프란시스코 날씨가 이날만큼은 협조해 준 가운데, OpenAI의 컴퓨팅 인프라 총괄 Sachin Katti가 서버를 가져와 준 Buck에게 감사를 전했습니다.
Buck은 Vera의 기능을 하나씩 설명하다가, 주머니에서 드라이버를 꺼내 덮개를 열고 시스템 내부를 보여주기도 했습니다.
5월의 첫 전달은 샌프란시스코 소마(SoMa)에 있는 Anthropic의 세련된 사무실에서 이뤄졌습니다.
Anthropic의 컴퓨팅 총괄 James Bradbury가 베이가 내려다보이는 회의실에서 시스템을 건네받았습니다.
Buck은 안내용으로 들고 온 NVIDIA Vera CPU 메인보드를 곁들여, 이 새로운 CPU를 중심으로 만들어진 서버를 Bradbury에게 설명하며 Vera를 다르게 만드는 특징들을 짚었습니다.
Bradbury는 “컴퓨팅 확장은 모델 성장의 중요한 촉진제”라며 “에이전틱 워크로드를 풀어내는 데 있어 Vera가 생태계의 유망한 축으로 떠오르는 모습을 기대하고 있다”고 말했습니다.
Vera는 NVIDIA Rubin GPU와 BlueField-4 DPU, Spectrum-X, MGX 랙 아키텍처와 함께 NVIDIA의 극한의 코디자인을 이루는 한 축입니다.
Vera는 단독 CPU 시스템을 구동하는 것은 물론, Vera Rubin NVL72의 호스트 프로세서 역할도 합니다. 여기서는 2세대 NVIDIA NVLink-C2C를 통해 Rubin GPU 두 개와 짝을 이룹니다.
한눈에 보는 Vera CPU
무엇인가 — 에이전틱 AI를 위해 설계된 NVIDIA 최초의 맞춤형 CPU
무엇을 처리하나 — 오케스트레이션, 도구 호출, 강화 학습 워크로드, 데이터 분석, 에이전트 샌드박싱, 긴 컨텍스트 상태 관리
누구를 위한 것인가 — 에이전틱 AI를 대규모로 운영하는 AI 연구소와 클라우드 사업자, 기업
핵심 사양 — 맞춤 설계된 Olympus 코어 88개, 메모리 대역폭 1.2TB/s, 에이전틱 AI 워크로드에서 최대 1.8배 빠른 코어당 성능
이러한 시스템에서 Vera와 Rubin은 통합 메모리 아키텍처를 공유해 가속 컴퓨팅의 활용도를 높게 유지합니다.
Vera의 빠른 CPU 코어와 인터커넥트는 GPU에 데이터를 공급하는 데 필요한 오케스트레이션과 제어, 데이터 이동을 처리하며, 기존 인프라 대비 2배의 에너지 효율을 냅니다.
에이전틱 AI의 시대에 그에 맞게 설계된 CPU가 등장했습니다. 그 이름은 Vera입니다.
NVIDIA Vera CPU에 대해 자세히 알아보세요.