Nvidia Wants to Own Every Chip Inside AI Data Centers
개요
Nvidia는 새로운 Vera Rubin 칩 시스템을 공개하며 GPU와 CPU를 결합한 성능을 선보였으며, AI 데이터센터 내 모든 칩 공급자로 자리매김하려는 전략을 강화하고 있습니다.
주요 내용
* Vera Rubin은 Nvidia의 Grace Blackwell 시스템의 후속작으로, 2개의 GPU당 1개의 CPU 비율을 특징으로 합니다.
* NVL 72 시스템에는 72개의 Rubin GPU와 36개의 Vera CPU가 포함되며, Vera CPU는 독립 제품으로도 판매될 예정입니다.
* Nvidia는 Vera Rubin 시스템이 이전 모델 대비 전력 효율성이 10배 향상되었으며, 에이전트 AI 작업 처리 속도도 빠르다고 주장합니다.
* 새로운 칩은 메모리 대역폭을 약 3배 늘렸으며, 케이블 연결을 최소화한 "케이블 없는 컴퓨팅" 및 "핫 스와핑" 기능을 제공합니다.
* Vera Rubin 시스템은 100% 액체 냉각 방식을 채택하여 에너지 효율성을 높였습니다.
* OpenAI는 이미 Vera Rubin 랙을 사용 중이며, Microsoft, Oracle 등도 초기 고객으로 참여합니다.
* Nvidia는 Vera Rubin이 칩렛 아키텍처 대신 모놀리식(monolithic) 칩 설계를 채택하여 메모리 대역폭 및 데이터 이동에 대한 "무거운 세금"을 줄였다고 설명합니다.
* 이러한 발표는 경쟁사인 AMD의 신제품 발표를 앞두고 이루어졌으며, 양사는 AI 데이터센터 칩 시장에서 치열한 경쟁을 벌이고 있습니다.
시사점
Vera Rubin 시스템은 Nvidia가 GPU 공급업체를 넘어 AI 데이터센터의 전반적인 컴퓨팅 인프라를 장악하려는 야심찬 계획을 보여주며, AI 에이전트 시스템의 발전과 함께 CPU의 중요성이 부각되고 있음을 시사합니다.
댓글
GitHub Discussions