예술적 실험을 위한 오픈 웨이트 모델 제품군, Stable Audio 3.0 공개
·2026.05.20 23:59
핵심 내용
Stability AI가 라이선스를 확보한 데이터로 학습된 오픈 웨이트 오디오 모델 Stable Audio 3.0을 공개했다.
자세히 보기
Stability AI가 예술적 실험을 지원하기 위해 설계된 차세대 오디오 모델 제품군인 Stable Audio 3.0을 공개했다. 이 모델들은 모두 완전히 라이선스를 확보한 데이터를 기반으로 학습되었으며, 3개의 모델이 **오픈 웨이트(open-weights)**로 제공되어 누구나 다운로드하고 활용할 수 있다.
제품군은 용도에 따라 네 가지 모델로 구성된다:
- Stable Audio 3.0 Small SFX: 모바일 및 저사양 노트북에서 구동 가능한 효과음 생성 모델
- Stable Audio 3.0 Small: 온디바이스(on-device)에서 완전한 음악 작곡이 가능한 모델
- Stable Audio 3.0 Medium: 최대 6분 20초 길이의 고품질 음악 구조와 멜로디를 제공하는 모델
- Stable Audio 3.0 Large: 대규모 음악 플랫폼 및 저지연 생성이 필요한 전문적인 환경을 위한 최상위 모델
Stable Audio 3.0은 새로운 semantic-acoustic autoencoder 아키텍처를 도입하여 더 길고 유연한 오디오 생성을 지원한다. 주요 특징은 다음과 같다:
- 가변 길이 생성: 초 단위의 정밀한 제어를 통해 최대 6분 이상의 오디오를 생성할 수 있다.
- 온디바이스 음악 작곡: Small 모델을 통해 오프라인 환경에서도 짧은 샘플이 아닌 완전한 음악 트랙을 제작할 수 있다.
- LoRa 지원: 사용자의 라이브러리에 맞춰 모델을 미세 조정(fine-tuning)할 수 있는 LoRa 학습 기능을 제공한다.
- 오디오 인페인팅(Inpainting): 트랙의 특정 구간을 수정하거나, 기존 곡을 확장(causal continuation)하는 편집 기능을 지원한다.
사용자는 Stability AI Community License에 따라 생성된 결과물을 자유롭게 배포하고 상업적으로 이용할 수 있다. 다만, 연간 매출 100만 달러 이상의 기업은 Enterprise License를 통해 상업적 보호 및 법적 면책 혜택을 받아야 한다.
이 한국어 요약은 AI가 자동으로 만들었습니다. 원문의 주장과 맥락은 원문에서 확인해 주세요. 저작권은 원저작자에게 있습니다.