TensorRT로 최적화된 Stable Diffusion 3.5, NVIDIA RTX GPU에서 성능 2배 향상 및 메모리 40% 절감
·2025.06.13 06:21
핵심 내용
Stability AI가 NVIDIA와 협력하여 TensorRT로 최적화된 Stable Diffusion 3.5 모델을 공개해 성능을 최대 2.3배 높였다.
자세히 보기
Stability AI는 NVIDIA와 협력하여 TensorRT 및 FP8 양자화 기술을 적용한 Stable Diffusion 3.5(SD3.5) 최적화 모델을 출시했다. 이번 최적화를 통해 지원되는 NVIDIA RTX GPU에서 이미지 생성 속도를 높이고 VRAM 요구량을 대폭 줄였다.
SD3.5 Large 모델은 기존 PyTorch 모델 대비 생성 속도가 최대 2.3배 빨라졌으며, VRAM 사용량은 19GB에서 11GB로 약 40% 감소했다. SD3.5 Medium 모델은 생성 속도가 1.7배 향상되어 효율적인 작업이 가능하다.
최적화된 모델은 다음과 같은 하드웨어에서 원활하게 작동한다:
- NVIDIA GeForce RTX 40 및 50 시리즈
- NVIDIA Blackwell 및 Ada Lovelace 아키텍처 기반 RTX PRO GPU
해당 모델은 Stability AI Community License에 따라 상업적 및 비상업적 용도로 사용할 수 있다. 모델 가중치는 Hugging Face에서, 관련 코드는 NVIDIA GitHub에서 확인할 수 있다.
이 한국어 요약은 AI가 자동으로 만들었습니다. 원문의 주장과 맥락은 원문에서 확인해 주세요. 저작권은 원저작자에게 있습니다.