llama.cpp, Qwen3-TTS 통합
Qwen3-TTS voice cloning is now in mainline llama.cpp — the old demo finally became real support
·2026.08.05 16:47
llama.cpp 메인라인에서 Qwen3-TTS 1.7B 음성 복제를 지원한다.
Qwen3-TTS-12Hz-1.7B-Base 음성 복제 구현이 llama.cpp 메인라인에 병합됐다.
이제 llama-tts 바이너리에서 약 3초 분량의 WAV·MP3 음성을 화자 참조 파일로 사용해 음성을 생성할 수 있다. 지원 언어는 다음과 같다.
- 영어, 중국어, 독일어, 이탈리아어
- 스페인어, 프랑스어, 포르투갈어, 러시아어
- 일본어, 한국어
현재 지원 범위는 1.7B Base 모델로 제한되며, CustomVoice와 VoiceDesign은 지원하지 않는다. /tts 서버 엔드포인트는 아직 초안 단계이고, 기존 llama-tts 바이너리에는 호환성을 깨는 변경이 포함됐다.
qwen3-tts.cpp나 audio.cpp와의 음성 유사도·속도·메모리 사용량 비교는 아직 공개되지 않았다.
이 요약은 원문 이해를 돕기 위한 큐레이션입니다. 저작권은 원저작자에게 있으며, 정확한 내용과 맥락은 원문을 확인하세요.
요약 오류, 출처 표기 문제, 삭제 요청은 문의 · 건의로 알려주세요.