Echo-TTS의 C++ 포트 공개
A C++ port of Echo-TTS
·2026.05.07 03:43
GGML과 ONNX Runtime을 활용해 효율적인 추론을 지원하는 Echo-TTS의 C++ 포트가 공개되었습니다.
스피커 참조 조건부(speaker reference conditioning)를 지원하는 멀티 스피커 Echo-TTS의 C++ 포트 버전이 공개되었습니다. 이 구현체는 GGML을 사용하여 Diffusion Transformer를 구동하고, ONNX Runtime을 통해 DAC 오토인코더를 처리하여 CUDA 기반 GPU 환경에서 동작합니다.
주요 특징:
- 모델 크기: Q8 양자화 시 약 3.3GB, F16 버전은 약 5.6GB
- 서버 모드: 청킹(chunking)을 지원하는 OpenAI 호환 서버 모드 제공
- 다양한 기능: 참조 WAV 파일을 이용한 멀티 보이스 지원, Euler 샘플링, 블록 단위 생성(blockwise generation) 및 연속 모드 지원
- 편의성: CUDA 12.8, cuDNN 9.21, ONNX Runtime이 포함된 휴대용 ZIP 파일 제공
현재 Windows 환경에서 테스트되었으며, GitHub와 Hugging Face를 통해 코드와 모델을 확인할 수 있습니다.
이 요약은 원문 이해를 돕기 위한 큐레이션입니다. 저작권은 원저작자에게 있으며, 정확한 내용과 맥락은 원문을 확인하세요.
요약 오류, 출처 표기 문제, 삭제 요청은 문의 · 건의로 알려주세요.