Resemble AI의 DramaBox 공개
DramaBox by Resemble AI
·2026.05.15 04:55
Resemble AI가 씬 설명을 음성 연기로 바꾸고 워터마킹까지 넣는 TTS DramaBox를 공개했다.
DramaBox는 씬 설명을 읽어 연기 톤의 음성을 만드는 prompt-driven TTS다.
- 대사는 큰따옴표 안에, 연기 지시는 큰따옴표 밖에 쓰는 스크립트 방식으로 동작한다.
- 10초 이상의 참조 음성이 있으면 해당 음색을 적용하고, 없으면 설명에 맞는 새 목소리를 생성한다.
- 출력은 48 kHz 스테레오이며, warm H100 서버 기준 약 2.5초에 생성된다.
- 모든 결과물은 기본으로 **Resemble Watermarker(PerTh)**로 워터마킹되며, 공식 페이지는 MP3/AAC 변환 후에도 약 100% 탐지 정확도를 제시한다.
- 모델은 open source이고 현재는 English-only다. Resemble 계정과 Hugging Face에서 사용할 수 있다.
- 기술적으로는 LTX-2.3 오디오 브랜치 위에 올린 IC-LoRA fine-tune이다.
Resemble는 자사 TTS 계열의 Hugging Face 누적 다운로드가 **1,000만+**를 넘었다고 밝혔다.
이 요약은 원문 이해를 돕기 위한 큐레이션입니다. 저작권은 원저작자에게 있으며, 정확한 내용과 맥락은 원문을 확인하세요.
요약 오류, 출처 표기 문제, 삭제 요청은 문의 · 건의로 알려주세요.