Resemble AI의 DramaBox 공개
DramaBox by Resemble AI
·2026.05.15 04:55
핵심 내용
Resemble AI가 씬 설명을 음성 연기로 바꾸고 워터마킹까지 넣는 TTS DramaBox를 공개했다.
1 / 2
자세히 보기
DramaBox는 씬 설명을 읽어 연기 톤의 음성을 만드는 prompt-driven TTS다.
- 대사는 큰따옴표 안에, 연기 지시는 큰따옴표 밖에 쓰는 스크립트 방식으로 동작한다.
- 10초 이상의 참조 음성이 있으면 해당 음색을 적용하고, 없으면 설명에 맞는 새 목소리를 생성한다.
- 출력은 48 kHz 스테레오이며, warm H100 서버 기준 약 2.5초에 생성된다.
- 모든 결과물은 기본으로 **Resemble Watermarker(PerTh)**로 워터마킹되며, 공식 페이지는 MP3/AAC 변환 후에도 약 100% 탐지 정확도를 제시한다.
- 모델은 open source이고 현재는 English-only다. Resemble 계정과 Hugging Face에서 사용할 수 있다.
- 기술적으로는 LTX-2.3 오디오 브랜치 위에 올린 IC-LoRA fine-tune이다.
Resemble는 자사 TTS 계열의 Hugging Face 누적 다운로드가 **1,000만+**를 넘었다고 밝혔다.
이 한국어 요약은 AI가 자동으로 만들었습니다. 원문의 주장과 맥락은 원문에서 확인해 주세요. 저작권은 원저작자에게 있습니다.