엔비디아 젠슨 황, CES 2026서 AI 칩 루빈 공개
AI가 소식을 시간 흐름에 따라 쉽게 정리해드려요.
10건의 연관 소식
• 26.01.05
뉴시스외 3개의 기사에선 이렇게 얘기했어요.
엔비디아, 2026년 AI 칩 루빈 출시 일정 및 성능 공개
엔비디아 최고경영자 젠슨 황이 2026년 1월 5일 CES 2026 행사에서 AI 칩 루빈을 직접 선보였습니다. 루빈은 기존 GPU 대비 연산 성능이 3.5배, 구동 성능이 5배 향상됐으며, 6종 칩으로 구성돼 1000개 이상 연결이 가능합니다. 이번에 루빈 아키텍처가 블랙웰 대비 추론 토큰 비용을 최대 10배 절감하고, 전문가혼합 AI 모델 학습 시 필요한 GPU 수를 약 4분의 1로 줄여 대규모 모델 학습의 총소유비용을 크게 낮춘다는 점이 새롭게 공개됐습니다. 마이크로소프트 애저, AWS, GCP 등 주요 클라우드 사업자와 메타, 오픈AI, xAI가 루빈 도입을 공식화했으며, 2026년 하반기부터 본격 공급이 시작될 예정입니다. 루빈은 Spectrum-X 이더넷 포토닉스 네트워크와 3세대 기밀 컴퓨팅 지원으로 전력 효율과 보안성도 강화됐습니다. 이번에 루빈 칩이 제조 파트너사로부터 전달되어 주요 테스트를 통과했고, 88코어 CPU 탑재로 데이터 처리 능력이 2배 향상됐으며, DGX SuperPod 등 다양한 형태로 공급될 예정입니다. 2026년 연말 출시 일정과 데이터센터 전력 사용 절감 효과가 추가로 확인됐습니다.
NVIDIA, 차세대 AI 칩 Rubin으로 추론 비용 10배 절감
✅NVIDIA, 차세대 AI 칩 Rubin 공개
📌Rubin 핵심 기술 포인트 추론 비용(inference token cost) → 최대 10배 절감
MoE(Mixture of Experts) 학습 효율 → Blackwell 대비 GPU 수 4배 감소 → 일부 워크로드에서 하드웨어 요구량 대폭 축소
네트워크 & 전력 효율 → Spectrum-X Ethernet Photonics 기반 → 전력 효율 + 가동률 5배 개선
보안 → 3세대 기밀 컴퓨팅(confidential computing) 지원 → 멀티테넌트·주권 AI 환경에 최적
**학습뿐 아니라 추론 비용 10배 절감은 → AI 서비스의 단가 구조 자체를 변화
대규모 모델의 상시 배포·실시간 응답이 현실화**
✅독립리서치 그로쓰리서치 https://t.me/growthresearch
세사모(세상 사는 모든 이야기)외 2개의 채널에선 이렇게 얘기했어요.
NVIDIA, Rubin AI 칩과 DGX 슈퍼컴퓨터 CES서 공개
» NVIDIA는 CES 2026 기조연설을 통해 차세대 AI 가속기인 Rubin 칩이 계획대로 순조롭게 개발되고 있으며 곧 출시될 예정이라고 발표
» 젠슨 황 CEO는 이번 행사에서 세계 전반의 AI 개발 속도를 높이기 위한 Rubin 데이터 센터 제품군의 출시가 임박했음을 강조하면서 현재 6종의 Rubin 칩이 제조 파트너사들로부터 전달되어 주요 마일스톤 테스트를 통과했다고 설명
» 새롭게 공개된 Rubin 아키텍처는 기존 Blackwell 제품과 비교했을 때 AI 학습 성능은 3.5배, 추론 성능은 5배 가량 향상. 함께 공개된 새로운 CPU는 88개의 코어를 탑재하여 데이터 처리 능력을 극대화했으며 이전 세대 부품 대비 2배의 성능을 제공하는 것이 특징
» NVIDIA는 평소 3월에 열리는 GTC 행사에서 구체적인 제품 정보를 공개하던 관례를 깨고 올해는 연초 CES에서 세부 정보를 일찍 공개하는 전략을 가지고 나왔으며, 이러한 행보는 가속화되는 AI 산업의 주도권을 유지하고 고객들이 타사 솔루션으로 이탈하지 않도록 강력한 하드웨어 로드맵을 선제적으로 제시하려는 의도로 추정
» Rubin 기반의 시스템은 더 적은 수의 부품으로 동일한 연산 결과를 낼 수 있도록 설계되어 운영 비용 측면에서도 Blackwell 버전보다 경제적이라는 장점 보유
» 해당 하드웨어는 개별 제품으로 공급될 뿐만 아니라 네트워킹 및 연결 구성 요소가 통합된 DGX SuperPod 슈퍼컴퓨터의 형태로도 제공되어 모듈식으로 유연하게 활용 가능. Microsoft와 같은 주요 클라우드 서비스 기업들은 하반기에 이 새로운 하드웨어를 가장 먼저 도입할 예정
» 시장 일각에서는 AI 지출 지속 가능성에 대한 의구심과 데이터 센터 운영사들의 자체 칩 개발로 인한 경쟁 심화 우려를 제기하고 있으나 NVIDIA는 여전히 수조 달러 규모의 전체 시장 잠재력을 낙관
엔비디아 루빈 GPU, AI 인프라 혁신과 하이퍼스케일러 채택
**🎯엔베디아, CES 2026에서 루빈 GPU 사양 발표
** **✅ 엔비디아 ‘루빈’, 성능 경쟁을 넘어 비용·운영 혁신 아키텍처로 진화 ** · 엔비디아 4세대 고성능 GPU 아키텍처 ‘루빈(Rubin)’은 블랙웰 대비 추론 토큰 비용을 최대 10배 절감 · 전문가혼합(MoE) AI 모델 학습 시 필요 GPU 수가 약 4분의 1로 감소, 대규모 모델 학습의 TCO 구조를 근본적으로 변화 · 루빈은 현재 양산 중이며, 2026년 하반기부터 파트너사를 통해 본격 공급 예정 · 케이블 없는(cableless) 모듈형 설계 - 조립 속도 18배 증가
**✅ 하이퍼스케일러 전면 채택… AI 인프라 표준으로 자리매김 ** · 마이크로소프트 애저, AWS, GCP 등 주요 클라우드 사업자가 루빈 도입을 공식화 · 메타, 오픈AI, xAI까지 포함되며 사실상 차세대 AI 인프라의 표준 GPU로 확정
**✅ 루빈 GPU 사양 (블랙웰 대비) ** ·NVFP4 Inference : 50PFLOPS, 5배 ·NVFP4 Training : 35PFLOPS, 3.5배 ·HBM4 Bandwidth : 22 TB/s, 2.8배 ·NVLink Bandwidth per GPU : 3.6 TB/s, 2배 ·Transistors 336 Billion개, 1.6배
엔비디아, 차세대 AI GPU '루빈' 공개
✅ 엔비디아, 차세대 AI GPU '루빈' 공개
https://n.news.naver.com/mnews/article/092/0002404780?sid=105
엔비디아, 차세대 AI GPU '루빈' 공개
엔비디아가 5일(이하 현지시간) 라스베이거스 퐁텐블로 시어터에서 진행한 기조연설에서 데이터센터용 차세대 AI GPU 플랫폼 '루빈'(Rubin)을 공개했다. 엔비디아는 2024년 컴퓨텍스 기조연설에서 블랙웰을 시작으
https://n.news.naver.com/mnews/article/092/0002404780?sid=105