AI Briefing

Intel CPU용 SD 5.1배 가속

Optimizing Stable Diffusion for Intel CPUs with NNCF and 🤗 Optimum

·2023.05.25 09:00

NNCF와 Optimum을 활용해 Intel CPU에서 Stable Diffusion의 추론 속도를 5.1배 높이는 최적화 방법을 제시한다.

Stable Diffusion의 핵심인 UNet 모델은 연산량이 매우 많아 GPU 없이 CPU만으로 구동할 경우 생성 속도가 매우 느리다는 단점이 있다.

기존의 8비트 양자화(Post-training quantization) 방식은 Stable Diffusion과 같은 복잡한 모델에서 정확도가 크게 떨어지는 문제가 발생한다. 이는 모델의 중복성이 낮고 방대한 정보를 포함하고 있기 때문이다.

이를 해결하기 위해 Hugging Face는 다음과 같은 워크플로우를 제안한다:

  • NNCF를 통한 양자화 인식 학습(QAT) 적용
  • **지식 증류(Knowledge Distillation)**를 활용해 최적화 과정 중 정확도 유지
  • Token Merging 기술 결합

이 방법을 적용한 결과, PyTorch 대비 5.1배의 추론 가속4배의 모델 크기 감소를 달성했다.

이 요약은 원문 이해를 돕기 위한 큐레이션입니다. 저작권은 원저작자에게 있으며, 정확한 내용과 맥락은 원문을 확인하세요.

요약 오류, 출처 표기 문제, 삭제 요청은 문의 · 건의로 알려주세요.