AI Briefing

llama.cpp, Qwen3-TTS 통합

Qwen3-TTS voice cloning is now in mainline llama.cpp — the old demo finally became real support

·2026.08.05 16:47

핵심 내용

llama.cpp 메인라인에서 Qwen3-TTS 1.7B 음성 복제를 지원한다.

자세히 보기

Qwen3-TTS-12Hz-1.7B-Base 음성 복제 구현이 llama.cpp 메인라인에 병합됐다.

이제 llama-tts 바이너리에서 약 3초 분량의 WAV·MP3 음성을 화자 참조 파일로 사용해 음성을 생성할 수 있다. 지원 언어는 다음과 같다.

  • 영어, 중국어, 독일어, 이탈리아어
  • 스페인어, 프랑스어, 포르투갈어, 러시아어
  • 일본어, 한국어

현재 지원 범위는 1.7B Base 모델로 제한되며, CustomVoice와 VoiceDesign은 지원하지 않는다. /tts 서버 엔드포인트는 아직 초안 단계이고, 기존 llama-tts 바이너리에는 호환성을 깨는 변경이 포함됐다.

qwen3-tts.cpp나 audio.cpp와의 음성 유사도·속도·메모리 사용량 비교는 아직 공개되지 않았다.

이 한국어 요약은 AI가 자동으로 만들었습니다. 원문의 주장과 맥락은 원문에서 확인해 주세요. 저작권은 원저작자에게 있습니다.

AI 처리 방식을 확인하거나, 요약 오류와 출처 표기 문제, 삭제 요청을 문의 · 건의로 알려주세요.