HuggingFace, 2024년 AI 아트 기술 정리
The AI tools for Art Newsletter - Issue 1
·2025.01.31 09:00
2024년 AI 이미지 및 비디오 생성 분야의 주요 기술적 전환점과 오픈소스 모델 성과를 요약했다.
2024년은 AI 이미지 생성 기술이 기존 Unet 기반 아키텍처에서 Diffusion Transformer (DiT) 및 Flow Matching 방식으로 패러다임이 전환된 중요한 해였다.
주요 기술적 성과와 모델은 다음과 같다:
- 이미지 생성 아키텍처의 변화: Stable Diffusion 3, 최초의 오픈소스 DiT 모델인 HunyuanDiT, AuraFlow, Flux.1, Stable Diffusion 3.5 등이 출시되며 기술적 흐름을 주도했다.
- Flux.1의 등장: 특히 **Flux.1 [dev]**는 다양한 벤치마크에서 Midjourney v6.0 및 DALL·E 3(HD)와 같은 폐쇄형 모델을 능가하는 성능을 보여주며 오픈소스 모델의 새로운 기준을 제시했다.
- 개인화 및 스타일 제어: Textual Inversion, DreamBooth, LoRA와 같은 기술의 발전으로 모델에 새로운 개념을 학습시키고 정교하게 제어하는 능력이 크게 향상되었다.
이 요약은 원문 이해를 돕기 위한 큐레이션입니다. 저작권은 원저작자에게 있으며, 정확한 내용과 맥락은 원문을 확인하세요.
요약 오류, 출처 표기 문제, 삭제 요청은 문의 · 건의로 알려주세요.