Datasets 오디오·비전 업데이트
Introducing new audio and vision documentation in 🤗 Datasets
·2022.07.28 09:00
핵심 내용
Hugging Face Datasets 라이브러리에 오디오 및 이미지 데이터 처리를 위한 새로운 문서와 기능이 추가되었습니다.
1 / 2
자세히 보기
Hugging Face가 🤗 Datasets 라이브러리에 오디오 및 비전(이미지) 데이터셋을 효율적으로 로드하고 처리할 수 있는 새로운 문서와 기능을 업데이트했습니다.
주요 업데이트 사항은 다음과 같습니다:
- Quickstart 업데이트: 오디오 및 이미지 데이터셋의 엔드투엔드(end-to-end) 예제를 포함하여, PyTorch 및 TensorFlow 환경에서의 데이터 로딩 및 처리 방법을 안내합니다.
to_tf_dataset함수 추가: 데이터셋을tf.data.Dataset형식으로 간편하게 변환하여 TensorFlow/Keras 모델 학습에 바로 사용할 수 있도록 지원합니다.- 전용 가이드 제공: 각 데이터 모달리티(modality)의 특성에 맞춘 전용 섹션을 신설하여, 오디오 신호의 자동 디코딩 및 리샘플링 등 모달리티별 상세 처리 방법을 제공합니다.
- ImageFolder 지원: 별도의 로딩 스크립트 작성 없이도 폴더 구조만으로 이미지 분류 데이터셋을 즉시 구축할 수 있는 기능을 강화했습니다.
이 한국어 요약은 AI가 자동으로 만들었습니다. 원문의 주장과 맥락은 원문에서 확인해 주세요. 저작권은 원저작자에게 있습니다.