AWS는 첫 NVIDIA Vera CPU 서버와 Vera Rubin GPU를 받았어. 시애틀에서 직접 전달한 사람은 NVIDIA 하이퍼스케일·HPC 부문 부사장 Ian Buck이었고.1
NVIDIA 공식 블로그가 2026년 8월 27일 갱신한 글에 따르면, AWS와 NVIDIA는 그 하루 전 16년 협력을 확장하며 GPU 200만 개 추가 공급과 Vera CPU 기반 인프라 도입을 발표했어.1 AWS가 Vera를 받은 게 처음은 아니야. Buck은 그전에 Oracle Cloud Infrastructure(OCI)와 Anthropic·OpenAI·SpaceXAI 세 곳의 AI 연구소에도 Vera CPU 시스템을 손수 전달했어.1
왜 GPU가 아니라 CPU인가
NVIDIA는 에이전틱 AI 확산을 이유로 든다. NVIDIA 하이퍼스케일·HPC 부문 부사장 Ian Buck은 “에이전트형 AI가 AI 팩토리에 새로운 CPU 국면을 만들고 있다 — 모델이 답하는 것에서 행동하는 것으로 옮겨가면서, Vera는 그 작업을 대규모로 계속 움직이게 하도록 만들어졌다”고 말했어.1
확인된 스펙
Vera는 NVIDIA가 새로 설계한 Olympus 코어 아키텍처를 쓰는 자체 Arm 서버 CPU야. NVIDIA의 기존 Grace CPU(Grace Hopper·Grace Blackwell 세대)의 후속작이고.2 코어 수는 88개, 메모리 대역폭은 1.2TB/s이며, 8개의 128비트 LPDDR5X 메모리 컨트롤러가 붙어 있어.12
칩 안쪽은 6개 다이로 나뉘어 있어. 컴퓨트 코어는 하나의 모놀리식 다이에 남기고, 메모리와 I/O는 별도 칩렛으로 옮긴 구조야. 시스템 I/O 다이에는 96레인의 PCIe/CXL I/O가 달려 있고, NVLink-C2C 인터페이스로 Rubin GPU와 연결하거나 다른 Vera 칩과 묶어 2P 순수 CPU 구성도 만들 수 있어.2 스레드 처리는 리소스를 공유하는 대신 정적으로 나눠 쓰는 공간적 멀티스레딩 방식을 택했고, 랙 전체 기밀 컴퓨팅을 위해 CPU·GPU·NIC를 함께 설계했어.2 Vera는 NVL72 랙스케일 시스템과 개별 Vera 서버 양쪽 형태로 나온다는 것도 확인돼.2
성능 쪽 확인된 수치는 이래. NVIDIA가 공개한 SPEC CPU 2026 기반 벤치마크에서 에이전틱 워크로드는 코어당 최대 1.8배, 데이터 처리 워크로드는 약 1.5배 빠르다고 밝혔는데, 이건 NVIDIA 스스로 “대리 워크로드(proxy workload)“라고 못 박은 수치야.2 Vera Rubin NVL72 랙에서는 2세대 NVLink-C2C로 Rubin GPU 두 개와 연결되며, 이 구성이 기존 인프라 대비 2배의 에너지 효율로 GPU에 데이터를 공급한다는 게 NVIDIA 설명이야.1
넷 중 셋은 아직 “배치 계획”이다
실물이 오간 것과 실제 대규모 배치는 다른 얘기야. OCI 제품관리 총괄 Karan Batta는 “OCI가 2026년부터 수십만 대 규모의 NVIDIA Vera CPU를 배치할 계획”이라고 밝혔고, OCI는 하이퍼스케일 규모로 Vera를 배치하는 첫 클라우드 제공업체라고 NVIDIA는 설명해.1 SpaceXAI는 강화학습 워크로드와 에이전트 기반 시뮬레이션 파이프라인에 Vera를 아직 “평가 중”이라고만 나와 있어.1 Anthropic·OpenAI는 Vera CPU 시스템을 전달받았다는 사실만 확인되고, 도입 규모나 일정은 이번 자료에 나오지 않아.1
실제로 대수·일정이 구체적으로 나온 곳은 AWS뿐이야. 그마저도 이번에 전달된 건 “첫 서버 한 대”고, GPU 200만 개 추가 공급 계획과 Vera CPU 인프라 도입이 각각 어떤 일정으로 맞물리는지는 이번 발표에 나와 있지 않아.1
이 CPU가 실리는 랙 자체의 스펙 — Rubin GPU의 연산 능력, NVLink 대역폭, 전력 효율 수치 — 은 이미 다른 글에서 짚었어. NVIDIA가 랙 전체를 다시 설계한 이유는 에이전트였다에서 확인할 수 있어.
다음에 볼 것
OCI가 말한 “수십만 대”가 실제로 몇 대, 언제 배치됐는지는 아직 확인할 수 없어. SpaceXAI의 “평가”가 실제 도입으로 이어지는지, Anthropic·OpenAI의 Vera 물량이 얼마인지도 이번 자료엔 없어. NVIDIA가 자체 SPEC CPU 2026 벤치마크에서 “대리 워크로드”라고 못 박은 1.8배·1.5배 수치가 독립 측정으로 재현되는지도 지켜볼 지점이야.
댓글