AI Briefing

audio.cpp 0.4, TTS 35개 모델 패밀리 지원

[audio.cpp] Release 0.4: Higgs Audio v3 TTS 4B (10x real time)+ Fish Audio S2 Pro in C++/GGML, full GGUF loading, Q8 speed and VRAM gains

·2026.07.24 09:44

핵심 내용

audio.cpp 0.4가 Higgs Audio v3 TTS와 Fish Audio S2 Pro 등을 추가하며 35개 모델 패밀리를 지원하고 Q8 GGUF로 속도·VRAM을 개선했다.

자세히 보기

audio.cpp 0.4가 출시되며 고품질 TTS 모델 지원과 GGUF 퍼스트클래스 지원이 핵심 변경사항으로 추가됐다.

신규 모델 지원:

  • Higgs Audio v3 TTS 4B
  • Fish Audio S2 Pro
  • Voxtral Realtime ASR
  • OuteTTS, VieNeu-TTS-v3 (커뮤니티 모델)

총 지원 모델 패밀리 수는 35개로 늘었으며, 모든 릴리스 모델이 GGUF를 지원한다.

RTX 5090 기준 CUDA Q8 GGUF 성능:

  • Higgs Audio TTS: 실시간 대비 8.8x–10.1x (워밍업 후), 장문 생성 8.5x
  • Fish Audio S2 Pro: 실시간 대비 3.1x–3.4x, 장문 3.3x
  • Voxtral ASR: 오프라인 15.7x, 스트리밍 TTFT 171ms

16-bit GGUF 대비 Q8은 최대 1.5x 속도 향상, 피크 VRAM 최대 37% 감소 효과를 보이나 모델별로 편차가 있어 지원 매트릭스를 공개 유지 중이다.

이 한국어 요약은 AI가 자동으로 만들었습니다. 원문의 주장과 맥락은 원문에서 확인해 주세요. 저작권은 원저작자에게 있습니다.

AI 처리 방식을 확인하거나, 요약 오류와 출처 표기 문제, 삭제 요청을 문의 · 건의로 알려주세요.