transcribe.cpp
·2026.07.19 09:38
ggml 기반의 고성능 멀티 모델 지원 음성 인식(ASR) 라이브러리가 공개되었습니다.
ggml을 기반으로 구축된 transcribe.cpp는 최신 음성 인식(ASR) 모델들을 폭넓게 지원하는 추론 라이브러리입니다. 기존의 whisper.cpp나 ONNX 방식의 한계를 극복하고, 다양한 플랫폼에서 일관된 성능과 정확도를 제공하는 것을 목표로 합니다.
주요 특징:
- 광범위한 모델 지원: 16개 ASR 제품군, 60개 이상의 모델을 지원하며 지속적으로 확장 중입니다.
- 하드웨어 가속: Vulkan, Metal, CUDA, TinyBLAS를 통한 가속을 지원하여 GPU 성능을 극대화합니다.
- 높은 신뢰성: 모든 모델에 대해 수치적 검증(Numerical Validation) 및 WER(Word Error Rate) 테스트를 완료하여 레퍼런스 구현체와 동일한 정확도를 보장합니다.
- 다양한 기능: 스트리밍 및 배치(Batch) 전사 기능을 지원하며, whisper.cpp의
.bin파일을 그대로 사용할 수 있는 높은 호환성을 제공합니다. - 개발자 친화적: Python, JavaScript/TypeScript, Rust, ObjC/Swift 등 4가지 언어의 바인딩을 공식 지원합니다.
이 요약은 원문 이해를 돕기 위한 큐레이션입니다. 저작권은 원저작자에게 있으며, 정확한 내용과 맥락은 원문을 확인하세요.
요약 오류, 출처 표기 문제, 삭제 요청은 문의 · 건의로 알려주세요.