audio.cpp 0.7, 62개 모델 패밀리 지원
[audio.cpp] Release 0.7: 62 audio model families (85+ variants), Arena UI for model comparison, MiniMax Music 3, FireRed TTS3/Audio, ControlFoley, Personaplex, and more
·2026.08.28 02:50
핵심 내용
로컬 오디오 AI 프레임워크 audio.cpp 0.7이 62개 모델 패밀리와 비교용 Arena UI를 지원하며 공개됐다.
자세히 보기
로컬 오디오 AI 프레임워크 audio.cpp의 0.7 버전이 출시되어 총 62개 모델 패밀리와 85개 이상의 모델 변형을 지원하게 됐다.
이번 업데이트의 핵심 기능은 Arena UI로, 동일한 입력을 여러 로컬 모델이나 GGUF 변형에 적용해 생성된 출력을 나란히 비교할 수 있다. 이는 스크립트를 작성하지 않고도 최적의 모델을 선택하는 데 유용하다.
주요 신규 모델
- TTS/음성: FireRedTTS3, MagpieTTS, PersonaPlex, F5-TTS/Habibi, MOSS VoiceGenerator, DotTTS Edit
- ASR/이해: FireRedAudio, IBM Granite Speech 5.0 TurboCTC, MMS Forced Aligner
- 음성 변환: MeanVC2
- 음악/생성: MiniMax Music 3, MiDashengLM-Gen, ControlFoley(실험적), ACE-Step 1.5 XL
- 도구: AudioSR
하드웨어 및 배포
기여자 테스트 결과, NVIDIA Jetson Orin NX 16GB에서는 40개 모델 패밀리 중 40개가, Orin Nano 8GB에서는 34개가 정상 작동하는 것으로 확인됐다.
배포 가능한 사전 빌드(Prebuilt)는 Windows(CPU, Vulkan, CUDA 12.4/13.3), Ubuntu x64(CPU, Vulkan), macOS(arm64 Metal, x64 CPU) 환경을 지원한다.
이 한국어 요약은 AI가 자동으로 만들었습니다. 원문의 주장과 맥락은 원문에서 확인해 주세요. 저작권은 원저작자에게 있습니다.