AI Briefing

audio.cpp 0.7, 62개 모델 패밀리 지원

[audio.cpp] Release 0.7: 62 audio model families (85+ variants), Arena UI for model comparison, MiniMax Music 3, FireRed TTS3/Audio, ControlFoley, Personaplex, and more

·2026.08.28 02:50

핵심 내용

로컬 오디오 AI 프레임워크 audio.cpp 0.7이 62개 모델 패밀리와 비교용 Arena UI를 지원하며 공개됐다.

자세히 보기

로컬 오디오 AI 프레임워크 audio.cpp의 0.7 버전이 출시되어 총 62개 모델 패밀리와 85개 이상의 모델 변형을 지원하게 됐다.

이번 업데이트의 핵심 기능은 Arena UI로, 동일한 입력을 여러 로컬 모델이나 GGUF 변형에 적용해 생성된 출력을 나란히 비교할 수 있다. 이는 스크립트를 작성하지 않고도 최적의 모델을 선택하는 데 유용하다.

주요 신규 모델

  • TTS/음성: FireRedTTS3, MagpieTTS, PersonaPlex, F5-TTS/Habibi, MOSS VoiceGenerator, DotTTS Edit
  • ASR/이해: FireRedAudio, IBM Granite Speech 5.0 TurboCTC, MMS Forced Aligner
  • 음성 변환: MeanVC2
  • 음악/생성: MiniMax Music 3, MiDashengLM-Gen, ControlFoley(실험적), ACE-Step 1.5 XL
  • 도구: AudioSR

하드웨어 및 배포

기여자 테스트 결과, NVIDIA Jetson Orin NX 16GB에서는 40개 모델 패밀리 중 40개가, Orin Nano 8GB에서는 34개가 정상 작동하는 것으로 확인됐다.

배포 가능한 사전 빌드(Prebuilt)는 Windows(CPU, Vulkan, CUDA 12.4/13.3), Ubuntu x64(CPU, Vulkan), macOS(arm64 Metal, x64 CPU) 환경을 지원한다.

이 한국어 요약은 AI가 자동으로 만들었습니다. 원문의 주장과 맥락은 원문에서 확인해 주세요. 저작권은 원저작자에게 있습니다.

AI 처리 방식을 확인하거나, 요약 오류와 출처 표기 문제, 삭제 요청을 문의 · 건의로 알려주세요.