AI Briefing

HuggingFace, 2024년 AI 아트 기술 정리

The AI tools for Art Newsletter - Issue 1

·2025.01.31 09:00

2024년 AI 이미지 및 비디오 생성 분야의 주요 기술적 전환점과 오픈소스 모델 성과를 요약했다.

2024년은 AI 이미지 생성 기술이 기존 Unet 기반 아키텍처에서 Diffusion Transformer (DiT)Flow Matching 방식으로 패러다임이 전환된 중요한 해였다.

주요 기술적 성과와 모델은 다음과 같다:

  • 이미지 생성 아키텍처의 변화: Stable Diffusion 3, 최초의 오픈소스 DiT 모델인 HunyuanDiT, AuraFlow, Flux.1, Stable Diffusion 3.5 등이 출시되며 기술적 흐름을 주도했다.
  • Flux.1의 등장: 특히 **Flux.1 [dev]**는 다양한 벤치마크에서 Midjourney v6.0 및 DALL·E 3(HD)와 같은 폐쇄형 모델을 능가하는 성능을 보여주며 오픈소스 모델의 새로운 기준을 제시했다.
  • 개인화 및 스타일 제어: Textual Inversion, DreamBooth, LoRA와 같은 기술의 발전으로 모델에 새로운 개념을 학습시키고 정교하게 제어하는 능력이 크게 향상되었다.

이 요약은 원문 이해를 돕기 위한 큐레이션입니다. 저작권은 원저작자에게 있으며, 정확한 내용과 맥락은 원문을 확인하세요.

요약 오류, 출처 표기 문제, 삭제 요청은 문의 · 건의로 알려주세요.