AI Briefing

Stable Audio Open

·2024.07.19 16:26

Creative Commons 데이터를 학습한 오픈 웨이트 텍스트-투-오디오 모델, Stable Audio Open이 공개되었다.

대부분의 텍스트-투-오디오 모델은 비공개로 운영되어 연구자와 아티스트가 이를 기반으로 발전시키기 어렵다. 이를 해결하기 위해 Creative Commons 데이터를 활용해 학습한 새로운 오픈 웨이트 모델인 Stable Audio Open이 등장했다.

Stable Audio Open은 다양한 평가 지표에서 최신 기술(SOTA)과 대등한 성능을 입증했다. 특히 FDopenl3 결과는 이 모델이 44.1kHz의 고품질 스테레오 사운드를 합성할 수 있는 잠재력을 갖췄음을 보여준다.

이 요약은 원문 이해를 돕기 위한 큐레이션입니다. 저작권은 원저작자에게 있으며, 정확한 내용과 맥락은 원문을 확인하세요.

요약 오류, 출처 표기 문제, 삭제 요청은 문의 · 건의로 알려주세요.