본문으로 건너뛰기

← 2026.08.27 뉴스레터

2026.08.27 발표 · NVIDIA Blog

CHIPS · INFRA (칩·인프라)

엔비디아 첫 에이전트용 CPU 'Vera' 대량 출하 시작

엔비디아가 에이전트용으로 처음 설계한 CPU 'Vera'의 대량 출하를 시작했습니다. AI 에이전트는 GPU 계산만으로 돌지 않습니다. 샌드박스 실행, 도구 호출, 오케스트레이션, 긴 맥락 검색이 모두 CPU 일입니다. Vera는 엔비디아가 직접 설계한 Olympus 코어 88개와 초당 1.2TB 메모리 대역폭으로, 에이전트 작업에서 코어당 성능이 최대 1.8배라고 엔비디아는 밝혔습니다.

핵심 사실 · 한눈에 보기

  • 엔비디아가 8월 27일 갱신한 글에서 Vera CPU가 대량 출하를 시작했다고 밝혔습니다(원래 5월 18일 게시).
  • Vera는 엔비디아 설계 Olympus 코어 88개, 메모리 대역폭 초당 1.2TB를 갖췄고, 에이전트 작업에서 코어당 최대 1.8배 빠르다고 밝혔습니다.
  • 5월에 Anthropic·OpenAI·SpaceXAI와 오라클 클라우드(OCI)에 첫 Vera 시스템을 직접 전달했고, 8월에는 AWS에 첫 Vera CPU 서버와 Vera Rubin GPU를 전달했습니다.
  • AWS와 엔비디아는 GPU 200만 개 추가와 Vera 기반 인프라 도입을 포함한 협력 확대를 발표했다고 엔비디아가 전했습니다.
  • OCI는 2026년부터 Vera CPU 수십만 개를 배치할 계획이라고 밝혔습니다.

왜 에이전트용 CPU인가

엔비디아는 '에이전트 AI가 AI 팩토리에 새로운 CPU의 순간을 만들고 있다'고 설명했습니다. 모델이 답만 하던 데서 행동하는 쪽으로 옮겨가면서, 답을 내기 위해 파이썬 코드를 생성하고 실행하는 일이 많아졌고, 이것이 CPU 수요를 키운다는 것입니다. 기존 CPU가 코어 수를 늘리는 데 집중했다면, Vera는 동시에 쏟아지는 실시간 작업에서 코어당 성능과 메모리 대역폭을 앞세웠습니다.

  • Olympus 코어 88개(엔비디아 자체 설계)
  • 메모리 대역폭 초당 1.2TB
  • 에이전트 작업 코어당 최대 1.8배
  • 전달처: Anthropic, OpenAI, SpaceXAI, OCI(5월) → AWS(8월)

AI마중 POINT · 해석

봐야 할 지점

GPU 회사가 CPU 시장으로 영역을 넓히는 장면입니다. AI 데이터센터에서 CPU는 그동안 인텔·AMD 또는 클라우드 회사의 자체 Arm 칩이 차지했는데, 엔비디아는 에이전트 작업에 맞춘 CPU를 GPU·네트워크와 묶어 '랙 전체'를 파는 전략을 택했습니다. 이 사이트 기록상 같은 주 엔비디아는 SpaceXAI가 차세대 에이전트 AI에 Vera CPU를 쓰겠다고 했다고 밝혔습니다.

다만 '1.8배'는 엔비디아가 정한 에이전트 워크로드 기준이며, 비교 대상 CPU는 이 글에 명시되지 않았습니다. 대형 AI 연구소와 클라우드에 첫 시스템을 '직접 전달'했다는 것은 상징적인 출하 행사에 가깝고, 실제 대량 배치 규모는 OCI의 '수십만 개 계획' 정도만 공개됐습니다.

그래서 나한테는?

누구에게 의미가 있나

소비자 변화는 없습니다. 에이전트가 코드를 실행하고 도구를 부르는 작업이 데이터센터에서 더 빨리 처리되면, 장기적으로 에이전트 작업의 응답 시간과 비용에 영향을 줄 수 있습니다.

  • 클라우드 이용 기업: OCI·AWS에서 Vera 기반 인스턴스가 나오면 에이전트 실행 환경 선택지가 늘어납니다.

미확인 · 공식 발표만으로 알 수 없는 것

발표에 없는 것

  • Vera CPU의 가격, 전력 소비, 비교 기준 CPU는 공개되지 않았습니다.
  • AWS에서 Vera 기반 서비스를 언제부터 쓸 수 있는지는 나오지 않았습니다.

SOURCE공식 원문 확인

수집 2026.09.30 · 정리 2026.10.01 · 수정 2026.10.05 · 원문 본문은 옮기지 않았습니다. 회사가 밝힌 수치·성능은 본문에서 출처를 붙여 구분했습니다.

같은 주제 · NVIDIA

NVIDIA 전체 →