AI Briefing

Datasets 오디오·비전 업데이트

Introducing new audio and vision documentation in 🤗 Datasets

·2022.07.28 09:00

Hugging Face Datasets 라이브러리에 오디오 및 이미지 데이터 처리를 위한 새로운 문서와 기능이 추가되었습니다.

Hugging Face가 🤗 Datasets 라이브러리에 오디오 및 비전(이미지) 데이터셋을 효율적으로 로드하고 처리할 수 있는 새로운 문서와 기능을 업데이트했습니다.

주요 업데이트 사항은 다음과 같습니다:

  • Quickstart 업데이트: 오디오 및 이미지 데이터셋의 엔드투엔드(end-to-end) 예제를 포함하여, PyTorch 및 TensorFlow 환경에서의 데이터 로딩 및 처리 방법을 안내합니다.
  • to_tf_dataset 함수 추가: 데이터셋을 tf.data.Dataset 형식으로 간편하게 변환하여 TensorFlow/Keras 모델 학습에 바로 사용할 수 있도록 지원합니다.
  • 전용 가이드 제공: 각 데이터 모달리티(modality)의 특성에 맞춘 전용 섹션을 신설하여, 오디오 신호의 자동 디코딩 및 리샘플링 등 모달리티별 상세 처리 방법을 제공합니다.
  • ImageFolder 지원: 별도의 로딩 스크립트 작성 없이도 폴더 구조만으로 이미지 분류 데이터셋을 즉시 구축할 수 있는 기능을 강화했습니다.

이 요약은 원문 이해를 돕기 위한 큐레이션입니다. 저작권은 원저작자에게 있으며, 정확한 내용과 맥락은 원문을 확인하세요.

요약 오류, 출처 표기 문제, 삭제 요청은 문의 · 건의로 알려주세요.