AI Briefing

Qwen, Qwen-Image-2.1 공개… 7B 모델로 경량화 및 투명도 지원

Qwen-Image-2.1 pasa de 20B a 7B y saca PNG con transparencia real: los requisitos para moverlo en local

·2026.09.22 15:43

핵심 내용

알리바바 Qwen이 파라미터를 7B로 줄이고 투명도 생성을 지원하는 이미지 생성 모델 Qwen-Image-2.1을 공개했다.

자세히 보기

알리바바 Qwen 팀이 9월 20일 새로운 이미지 생성 모델 Qwen-Image-2.1을 공개했다. Hugging Face, ModelScope, GitHub에서 가중치를 다운로드할 수 있다.

모델 구조 및 성능

  • 파라미터 축소: 이전 버전(20B) 대비 파라미터 수를 7B로 대폭 줄였으며, 32층 DiT 구조를 채택했다.
  • 성능: Qwen 측 벤치마크 기준, Nano Banana 2.0(59.82)과 GPT-1.5(59.65)를 약간 상회하는 60.28점을 기록했으나, 독립적인 검증은 아직 이루어지지 않았다.
  • 해상도: 2048x2048부터 2752x1536까지 2K 네이티브 해상도를 지원한다.

주요 기능 및 요구 사항

  • 투명도 지원: 후처리 없이 알파 채널이 포함된 PNG를 직접 생성한다.
  • 다중 이미지 참조: 최대 10개의 참조 이미지를 입력하여 객체 일관성을 유지하며 장면을 합성할 수 있다.
  • 하드웨어 요구 사항: 디스크 용량은 약 33GB가 필요하며, 디코더는 **RTX 3090(24GB VRAM)**급 소비자용 하드웨어에서 구동 가능하다. 공식 코드는 일부 모델 부분을 시스템 RAM으로 오프로드하는 기능을 지원하며, 양자화 버전도 존재한다.

라이선스 변경

  • 첫 번째 버전의 Apache 2.0 라이선스와 달리, 이번 버전은 Qwen Research License를 적용하여 연구 목적으로만 사용이 제한된다.

이 한국어 요약은 AI가 자동으로 만들었습니다. 원문의 주장과 맥락은 원문에서 확인해 주세요. 저작권은 원저작자에게 있습니다.

AI 처리 방식을 확인하거나, 요약 오류와 출처 표기 문제, 삭제 요청을 문의 · 건의로 알려주세요.