Echo-TTS의 C++ 포트 공개
A C++ port of Echo-TTS
·2026.05.07 03:43
핵심 내용
GGML과 ONNX Runtime을 활용해 효율적인 추론을 지원하는 Echo-TTS의 C++ 포트가 공개되었습니다.
자세히 보기
스피커 참조 조건부(speaker reference conditioning)를 지원하는 멀티 스피커 Echo-TTS의 C++ 포트 버전이 공개되었습니다. 이 구현체는 GGML을 사용하여 Diffusion Transformer를 구동하고, ONNX Runtime을 통해 DAC 오토인코더를 처리하여 CUDA 기반 GPU 환경에서 동작합니다.
주요 특징:
- 모델 크기: Q8 양자화 시 약 3.3GB, F16 버전은 약 5.6GB
- 서버 모드: 청킹(chunking)을 지원하는 OpenAI 호환 서버 모드 제공
- 다양한 기능: 참조 WAV 파일을 이용한 멀티 보이스 지원, Euler 샘플링, 블록 단위 생성(blockwise generation) 및 연속 모드 지원
- 편의성: CUDA 12.8, cuDNN 9.21, ONNX Runtime이 포함된 휴대용 ZIP 파일 제공
현재 Windows 환경에서 테스트되었으며, GitHub와 Hugging Face를 통해 코드와 모델을 확인할 수 있습니다.
이 한국어 요약은 AI가 자동으로 만들었습니다. 원문의 주장과 맥락은 원문에서 확인해 주세요. 저작권은 원저작자에게 있습니다.