AI Briefing

Datasets 오디오·비전 업데이트

Introducing new audio and vision documentation in 🤗 Datasets

·2022.07.28 09:00

핵심 내용

Hugging Face Datasets 라이브러리에 오디오 및 이미지 데이터 처리를 위한 새로운 문서와 기능이 추가되었습니다.

1 / 2

자세히 보기

Hugging Face가 🤗 Datasets 라이브러리에 오디오 및 비전(이미지) 데이터셋을 효율적으로 로드하고 처리할 수 있는 새로운 문서와 기능을 업데이트했습니다.

주요 업데이트 사항은 다음과 같습니다:

  • Quickstart 업데이트: 오디오 및 이미지 데이터셋의 엔드투엔드(end-to-end) 예제를 포함하여, PyTorch 및 TensorFlow 환경에서의 데이터 로딩 및 처리 방법을 안내합니다.
  • to_tf_dataset 함수 추가: 데이터셋을 tf.data.Dataset 형식으로 간편하게 변환하여 TensorFlow/Keras 모델 학습에 바로 사용할 수 있도록 지원합니다.
  • 전용 가이드 제공: 각 데이터 모달리티(modality)의 특성에 맞춘 전용 섹션을 신설하여, 오디오 신호의 자동 디코딩 및 리샘플링 등 모달리티별 상세 처리 방법을 제공합니다.
  • ImageFolder 지원: 별도의 로딩 스크립트 작성 없이도 폴더 구조만으로 이미지 분류 데이터셋을 즉시 구축할 수 있는 기능을 강화했습니다.

이 한국어 요약은 AI가 자동으로 만들었습니다. 원문의 주장과 맥락은 원문에서 확인해 주세요. 저작권은 원저작자에게 있습니다.

AI 처리 방식을 확인하거나, 요약 오류와 출처 표기 문제, 삭제 요청을 문의 · 건의로 알려주세요.