AI Briefing

Stability AI, 기업용 대규모 사운드 제작을 위한 최초의 오디오 모델 Stable Audio 2.5 공개

·2025.09.10 23:07

핵심 내용

Stability AI가 기업의 대규모 사운드 제작을 지원하는 고품질 오디오 모델 Stable Audio 2.5를 출시했다.

자세히 보기

Stability AI가 기업의 대규모 사운드 제작을 위해 설계된 최초의 오디오 생성 모델, Stable Audio 2.5를 출시했다. 이 모델은 브랜드가 고유한 사운드 정체성을 다양한 채널에 일관되게 적용할 수 있도록 돕는다.

주요 개선 사항은 다음과 같다:

  • 빠른 생성 속도: ARC(Adversarial Relativistic-Contrastive) 방식을 통해 GPU에서 3분 길이의 트랙을 2초 미만으로 생성할 수 있다.
  • 지능적 작곡: 음악의 구조(도입, 전개, 종결)를 이해하며, 분위기나 악기 묘사 등 프롬프트 준수 능력이 향상되었다.
  • 오디오 인페인팅(Inpainting): 사용자가 입력한 오디오의 맥락을 파악해 나머지 부분을 자연스럽게 생성하는 기능을 지원한다.

Stable Audio 2.5는 저작권이 확보된 라이선스 데이터셋으로 학습되어 상업적 이용이 안전하다. 또한 기업의 사운드 라이브러리를 활용한 **파인튜닝(Fine-tuning)**을 지원하여, 브랜드만의 독보적인 음향 정체성을 구축할 수 있도록 돕는다.

현재 이 모델은 Stability AI API, fal, Replicate, ComfyUI를 통해 이용 가능하며, 기업용 라이선스를 통한 온프레미스 배포 및 맞춤형 솔루션도 제공된다.

이 한국어 요약은 AI가 자동으로 만들었습니다. 원문의 주장과 맥락은 원문에서 확인해 주세요. 저작권은 원저작자에게 있습니다.

AI 처리 방식을 확인하거나, 요약 오류와 출처 표기 문제, 삭제 요청을 문의 · 건의로 알려주세요.