사건 발표일 · NVIDIA
NVIDIA Vera Rubin NVL72, MLPerf Inference v6.1 첫 결과 공개
NVIDIA는 Vera Rubin NVL72의 MLPerf Inference v6.1 preview 결과를 공개했고, 자체 비교 구성에서 Qwen3-VL throughput이 GB300 NVL72보다 최대 3.7배 높았다고 밝혔습니다.
왜 중요한가
Vera Rubin의 추론 성능을 처음 수치로 볼 수 있는 초기 신호이지만 실제 운영 배치와는 구분합니다.
발표·기사 원문 · NVIDIA ↗