텍스트-이미지 오픈 선호도 데이터셋 공개
Open Preference Dataset for Text-to-Image Generation by the 🤗 Community
·2024.12.09 09:00
핵심 내용
Hugging Face 커뮤니티가 텍스트-이미지 생성 모델 학습을 위한 오픈 소스 선호도 데이터셋을 공개했다.
1 / 2
자세히 보기
Hugging Face의 'Data is Better Together' 커뮤니티가 Apache 2.0 라이선스의 **텍스트-이미지 선호도 데이터셋(Open Image Preferences)**을 출시했다. 이 데이터셋은 오픈 소스 이미지 생성 모델의 성능 향상을 위해 부족했던 선호도 데이터를 제공하는 데 목적이 있다.
데이터셋은 다양한 모델 제품군과 복잡한 프롬프트를 포함하며, 다음과 같은 특징을 갖는다:
- 프롬프트 다양성:
distilabel을 사용하여 프롬프트의 카테고리와 복잡도를 합성 데이터로 확장해 데이터의 질을 높였다. - 안전성 필터링: 텍스트 및 이미지 기반의 다중 분류기를 사용하여 NSFW 및 유해 콘텐츠를 제거하고, 수동 검토를 통해 안전성을 확보했다.
- 즉시 활용 가능한 자원: 선호도 데이터셋뿐만 아니라 이진화(binarized) 버전, 그리고 Flux-dev-lora-finetune 모델을 함께 제공한다.
사용자는 Hugging Face Hub에서 데이터셋을 내려받을 수 있으며, GitHub를 통해 전처리 및 후처리 코드를 확인할 수 있다.
이 한국어 요약은 AI가 자동으로 만들었습니다. 원문의 주장과 맥락은 원문에서 확인해 주세요. 저작권은 원저작자에게 있습니다.