NVIDIA는 지난달 캘리포니아 팔로알토에서 열린 Hot Chips 컨퍼런스에서 Blackwell의 다음 세대 랙 Vera Rubin NVL72의 스펙을 공개했어.1 그런데 그 뒤로 나온 소식은 스펙표 이상이야. NVIDIA는 이 랙의 효율에 새 숫자를 붙였고, 그 숫자에 기가와트당 매출이라는 값을 매겼고, 그리고 실제로 첫 양산분이 고객사에 도착했다는 소식도 나왔어.

와트당 토큰, 이번엔 GB300 앞에서

NVIDIA는 실제 에이전틱 코딩 세션을 그대로 재현한 SemiAnalysis의 AgentX 워크로드로 Vera Rubin NVL72를 측정했다고 밝혔어. 컨텍스트가 누적되고, 도구를 호출하고, 서브 에이전트를 띄우는 과정까지 그대로 살린 워크로드야.2 이 측정에서 나온 결과는 GB300 NVL72 대비 메가와트당 처리량 최대 30배, 백만 토큰당 비용 최대 35배 낮다는 것.2

이 배율이 왜 필요한지는 토큰 소비량에서 나와. OpenRouter 데이터에 따르면 에이전틱 AI 워크로드는 단순 채팅 요청보다 토큰을 15배 더 쓴다.2 회사 하나를 조사해 투자 판단을 내리는 에이전트를 생각해보면 감이 와 — 재무 데이터베이스를 조회하고, 뉴스와 공시를 검색하고, 하위 에이전트를 불러 밸류에이션을 비교하고, 그걸 다 종합해 추천안을 만들어. 매 단계에서 쌓인 토큰이 다음 단계의 입력이 되니까, 롱컨텍스트 처리 능력이 에이전틱 AI 성능의 핵심이 돼.2

다만 이 30배·35배는 아직 SemiAnalysis의 검토를 통과하지 않은 수치이고, Vera CPU의 툴 콜링 성능은 반영되지 않았다는 게 NVIDIA 스스로 붙인 단서야.2 NVIDIA DSX MaxLPS라는 전력 관리 기술이 GPU·랙·워크로드 단위로 전력을 배분해 같은 메가와트 예산 안에 GPU를 최대 40% 더 얹는다는 설명도 함께 나왔어.2

배율에 달러를 붙이면

이 배율이 왜 투자자에게 의미가 있는지는 젠슨 황이 실적 콜에서 직접 숫자로 그렸어. 기가와트당 매출 기회가 Blackwell 이전 세대인 Hopper에서 약 180억 달러였다가, Grace Blackwell에서 약 250억 달러로, 이제 Vera Rubin에서 약 400억 달러로 올랐다는 거야.3 CFO 콜레트 크레스도 같은 상승 흐름을 재확인했어.3 범용 컴퓨팅의 기가와트당 매출 기회가 30억~50억 달러 수준이었던 것과 비교하면, 몇 세대 만에 자릿수 하나가 늘어난 셈이야.3

이 숫자가 말하는 건 NVIDIA가 GPU 한 장을 파는 게 아니라는 점이야. Vera CPU·Rubin GPU·NVLink·네트워킹까지 묶은 AI 팩토리 전체를 팔기 때문에, 기가와트 하나에 붙는 지출을 더 많이 가져간다는 논리지.3 젠슨 황은 하이퍼스케일러들의 누적 백로그가 약 2조 달러에 이른다고도 밝혔어.3 이 배경 위에서 나온 회계연도 2분기 실적은 매출 962억 달러(전년 대비 106% 증가), 데이터센터 매출 890억 달러(전년 대비 117% 증가), 총마진 75%였어.3

물론 전력망이 없으면 이 400억 달러도 존재하지 않는 기가와트 위의 숫자일 뿐이야. 그리드 연결, 변전소, 건설 기간, 반도체 공급 모두 여전히 병목으로 남아 있어.3

무대에서 마이크로소프트 데이터센터까지

숫자 얘기만 있었던 건 아니야. 마이크로소프트 CEO 사티아 나델라가 자사 링크드인에 자기 회사 데이터센터에 첫 양산분 Vera Rubin이 도착한 인도일이라고 밝히며 사진을 올렸어. NVIDIA와 Azure 하드웨어·데이터센터 팀에 감사를 전하는 짧은 글이었지.4 스펙 발표와 배율 계산이 무대 위의 이야기였다면, 이건 그 랙이 실제로 상자에 담겨 도착했다는 확인이야.

다음에 볼 것

지금 나온 30배·35배는 NVIDIA가 직접 낸 수치고 아직 SemiAnalysis 검토가 끝나지 않았어.2 이 검토가 나오면 배율이 그대로 유지되는지, Vera CPU의 툴 콜링 성능을 더하면 숫자가 더 올라가는지가 먼저 갈릴 지점이야. 그다음은 마이크로소프트 외에 다른 하이퍼스케일러들도 같은 양산분을 받았다는 확인이 나오는지, 그리고 다음 분기 실적 콜에서 기가와트당 매출 400억 달러가 실제 계약·매출로 이어지는 숫자로 나오는지야.

각주

  1. NVIDIA가 랙 전체를 다시 설계한 이유는 에이전트였다에서 Hot Chips 2026 스펙 공개를 정리했다. ↩︎

  2. NVIDIA, 「Up to 30x More Work Per Watt: NVIDIA Vera Rubin NVL72 Sets a New Efficiency Standard for AI Agents」(2026-08-24) 원문 ↩︎ ↩︎2 ↩︎3 ↩︎4 ↩︎5 ↩︎6 ↩︎7

  3. Rich Duprey/Barchart via Yahoo Finance, 「Jensen Huang: Nvidia’s Vera Rubin Platform Turns Electricity Into a $40 Billion Cash Machine」(2026-09) 원문 ↩︎ ↩︎2 ↩︎3 ↩︎4 ↩︎5 ↩︎6 ↩︎7

  4. Satya Nadella, LinkedIn 게시물(2026-08) 원문 ↩︎