Qwen, 이미지 평가 모델 Q-Judger 공개
Qwen/Qwen-Image-Bench · Hugging Face
·2026.05.28 16:57
Qwen이 텍스트-이미지 생성 품질을 자동 평가하는 VLM 모델인 Q-Judger를 공개했다.
Q-Judger는 텍스트 프롬프트와 생성된 이미지를 입력받아 이미지의 품질을 정밀하게 평가하는 **Vision-Language Model(VLM)**입니다.
Qwen3.6-27B를 기반으로 파인튜닝되었으며, Chain-of-Thought(CoT) 추론 과정을 거쳐 최종 점수를 산출하는 것이 특징입니다.
평가는 다음과 같은 주요 차원을 포함한 3단계 계층 구조로 수행됩니다:
- Quality: 실사감(Realism), 디테일, 해상도
- Aesthetics: 구도, 색상 조화, 조명, 인체 해부학적 정확도, 스타일 제어 등
- Alignment: 속성, 동작, 레이아웃, 관계, 장면 일치 여부
- Real-world Fidelity: 공정성, 안전성 및 준수 여부
모델은 평가 결과를 구조화된 JSON 형식으로 출력하며, 각 차원별로 0(Fail)부터 2(Excel)까지의 점수를 제공합니다.
이 요약은 원문 이해를 돕기 위한 큐레이션입니다. 저작권은 원저작자에게 있으며, 정확한 내용과 맥락은 원문을 확인하세요.
요약 오류, 출처 표기 문제, 삭제 요청은 문의 · 건의로 알려주세요.