AI Briefing

audio.cpp 0.4, TTS 35개 모델 패밀리 지원

[audio.cpp] Release 0.4: Higgs Audio v3 TTS 4B (10x real time)+ Fish Audio S2 Pro in C++/GGML, full GGUF loading, Q8 speed and VRAM gains

·2026.07.24 09:44

audio.cpp 0.4가 Higgs Audio v3 TTS와 Fish Audio S2 Pro 등을 추가하며 35개 모델 패밀리를 지원하고 Q8 GGUF로 속도·VRAM을 개선했다.

audio.cpp 0.4가 출시되며 고품질 TTS 모델 지원과 GGUF 퍼스트클래스 지원이 핵심 변경사항으로 추가됐다.

신규 모델 지원:

  • Higgs Audio v3 TTS 4B
  • Fish Audio S2 Pro
  • Voxtral Realtime ASR
  • OuteTTS, VieNeu-TTS-v3 (커뮤니티 모델)

총 지원 모델 패밀리 수는 35개로 늘었으며, 모든 릴리스 모델이 GGUF를 지원한다.

RTX 5090 기준 CUDA Q8 GGUF 성능:

  • Higgs Audio TTS: 실시간 대비 8.8x–10.1x (워밍업 후), 장문 생성 8.5x
  • Fish Audio S2 Pro: 실시간 대비 3.1x–3.4x, 장문 3.3x
  • Voxtral ASR: 오프라인 15.7x, 스트리밍 TTFT 171ms

16-bit GGUF 대비 Q8은 최대 1.5x 속도 향상, 피크 VRAM 최대 37% 감소 효과를 보이나 모델별로 편차가 있어 지원 매트릭스를 공개 유지 중이다.

이 요약은 원문 이해를 돕기 위한 큐레이션입니다. 저작권은 원저작자에게 있으며, 정확한 내용과 맥락은 원문을 확인하세요.

요약 오류, 출처 표기 문제, 삭제 요청은 문의 · 건의로 알려주세요.