AI Briefing

이미지 생성 품질 평가 모델 Q-Judger 공개

Qwen/Qwen-Image-Bench · Hugging Face

·2026.05.28 16:57

텍스트-이미지 생성 품질을 다각도로 자동 평가하는 VLM 모델 Q-Judger가 공개되었습니다.

Q-Judger는 텍스트-이미지 생성 결과물을 자동 평가하기 위해 미세 조정된 시각-언어 모델(VLM)입니다. Qwen3.6-27B를 기반으로 하며, 텍스트 프롬프트와 이미지를 입력받아 정교한 품질 기준에 따라 구조화된 JSON 점수를 출력합니다.

모델은 Thinking Mode를 통해 최종 점수를 산출하기 전 사고 과정(Chain-of-Thought)을 거치며, 평가 결과는 0(Fail), 1(Pass), 2(Excel)의 3단계 계층 구조로 제공됩니다.

평가 항목은 다음과 같이 광범위한 차원을 포함합니다:

  • 품질(Quality): 사실주의, 디테일, 해상도, 미학, 구도, 색상, 조명 등
  • 정렬(Alignment): 속성, 동작, 레이아웃, 관계, 장면 등
  • 공정성 및 안전성(Fairness & Safety): 사회적 편향, 문화적 공정성, 안전 규정 준수
  • 창의적 생성(Creative Generation): 상상력, 텍스트 렌더링, 디자인 응용, 시각적 스토리텔링 등

이 요약은 원문 이해를 돕기 위한 큐레이션입니다. 저작권은 원저작자에게 있으며, 정확한 내용과 맥락은 원문을 확인하세요.

요약 오류, 출처 표기 문제, 삭제 요청은 문의 · 건의로 알려주세요.