가장 빠르고, 크고, 강력하다: NVIDIA Blackwell, MLPerf Training 6.0 석권
·2026.06.17 00:00
NVIDIA Blackwell 플랫폼이 MLPerf Training 6.0 벤치마크의 모든 카테고리에서 압도적인 성능을 기록하며 AI 학습 인프라의 리더십을 입증했다.
NVIDIA의 Blackwell 플랫폼이 최신 MLPerf Training 6.0 벤치마크에서 모든 카테고리를 석권하며 압도적인 성능을 증명했습니다. NVIDIA는 모든 벤치마크 항목에 제출된 유일한 플랫폼으로서, 모든 항목에서 가장 빠른 학습 시간을 기록했습니다.
이번 벤치마크에는 MoE(Mixture-of-Experts) 아키텍처의 중요성을 반영하여 DeepSeek-V3 671B와 GPT-OSS-20B라는 두 가지 새로운 사전 학습 워크로드가 추가되었습니다. NVIDIA는 NVLink의 높은 대역폭을 활용해 대규모 MoE 학습 시 발생하는 통신 병목 현상을 효과적으로 해결했습니다.
주요 성과는 다음과 같습니다:
- 모든 벤치마크에서 가장 빠른 학습 속도 달성
- NVIDIA Blackwell NVL72 시스템을 통해 8,192개의 GPU 규모로 대규모 학습 수행
- GB300 NVL72 시스템은 동일 규모의 GB200 NVL72 대비 최대 1.6배 빠른 성능 제공
또한 NVIDIA는 NVFP4 저정밀도 학습 기술을 통해 성능을 극대화하면서도 정확도를 유지하는 혁신을 보여주었습니다. 이는 최근 NVIDIA Nemotron 3 Ultra 모델의 사전 학습에도 적용되었습니다.
이 요약은 원문 이해를 돕기 위한 큐레이션입니다. 저작권은 원저작자에게 있으며, 정확한 내용과 맥락은 원문을 확인하세요.
요약 오류, 출처 표기 문제, 삭제 요청은 문의 · 건의로 알려주세요.