Black Forest Labs, FLUX.2 공개
Diffusers welcomes FLUX-2
·2025.11.25 09:00
Black Forest Labs의 신규 이미지 생성 모델 FLUX.2가 공개되었으며, Diffusers 라이브러리에서 사용할 수 있다.
Black Forest Labs가 새로운 이미지 생성 및 편집 모델인 FLUX.2를 공개했다. FLUX.1의 단순 업데이트가 아닌, 완전히 새로운 아키텍처로 처음부터 사전 학습된 모델이다.
주요 아키텍처 변화
- 텍스트 인코더: 기존의 이중 인코더 구조에서 벗어나 Mistral Small 3.1 단일 인코더를 채택하여 프롬프트 임베딩 계산을 단순화했다.
- DiT 구조 개선: 모든 레이어에서 bias 파라미터를 제거했으며, 시간 및 가이던스 정보를 모든 블록에서 공유하도록 설계했다.
- 병렬 트랜스포머 블록: Attention QKV 투영과 FF 입력 투영을 융합한 **완전 병렬 트랜스포머 블록(fully parallel transformer block)**을 도입했다.
- 싱글 스트림 비중 확대: 전체 파라미터 중 싱글 스트림 블록의 비중을 FLUX.1 대비 크게 높였다.
추론 및 사용
- VRAM 요구사항: 모델 규모가 커짐에 따라 오프로딩 없이 추론할 경우 80GB 이상의 VRAM이 필요하다.
- 라이브러리 지원: Hugging Face의 Diffusers 라이브러리를 통해 이미지 생성, 편집 및 LoRA 파인튜닝이 가능하다.
이 요약은 원문 이해를 돕기 위한 큐레이션입니다. 저작권은 원저작자에게 있으며, 정확한 내용과 맥락은 원문을 확인하세요.
요약 오류, 출처 표기 문제, 삭제 요청은 문의 · 건의로 알려주세요.