Stable Audio Open
·2024.07.19 16:26
핵심 내용
Creative Commons 데이터를 학습한 오픈 웨이트 텍스트-투-오디오 모델, Stable Audio Open이 공개되었다.
자세히 보기
대부분의 텍스트-투-오디오 모델은 비공개로 운영되어 연구자와 아티스트가 이를 기반으로 발전시키기 어렵다. 이를 해결하기 위해 Creative Commons 데이터를 활용해 학습한 새로운 오픈 웨이트 모델인 Stable Audio Open이 등장했다.
Stable Audio Open은 다양한 평가 지표에서 최신 기술(SOTA)과 대등한 성능을 입증했다. 특히 FDopenl3 결과는 이 모델이 44.1kHz의 고품질 스테레오 사운드를 합성할 수 있는 잠재력을 갖췄음을 보여준다.
이 한국어 요약은 AI가 자동으로 만들었습니다. 원문의 주장과 맥락은 원문에서 확인해 주세요. 저작권은 원저작자에게 있습니다.