NVIDIA가 루빈(Rubin) GPU 아키텍처를 공개하며 에이전트 AI 시대의 기반을 마련했어요. 루빈은 기존 Hopper 대비 전력 효율을 2배 향상시키고, AI 추론 성능을 3배 높여요.
루빈 아키텍처는 TensorRT-LLM과 결합해 대규모 언어 모델(LLM) 추론을 최적화하고, 새로운 칩 설계로 AI 에이전트의 지속적인 운영을 지원해요.
NVIDIA는 루빈 기반 시스템을 통해 AI 모델 개발 및 배포 비용을 절감하고, 더 많은 기업이 AI 기술을 활용할 수 있도록 지원할 계획이에요.