AI Briefing

Whisper 및 이전 모델과 비교한 Apple의 새로운 SpeechAnalyzer API 벤치마크

·2026.07.14 01:06

Apple의 새로운 SpeechAnalyzer API가 Whisper 모델보다 높은 정확도와 빠른 속도를 기록하며 온디바이스 음성 인식 성능을 압도했다.

Apple의 새로운 온디바이스 음성 엔진인 SpeechAnalyzer가 LibriSpeech 벤치마크 테스트 결과, 기존 SFSpeechRecognizer와 OpenAI의 Whisper 모델들을 모두 능가하는 성능을 보였습니다.

주요 벤치마크 결과 (LibriSpeech 기준):

  • 정확도 (WER): SpeechAnalyzer는 깨끗한 음성에서 2.12%, 소음이 있는 음성에서 **4.56%**의 단어 오류율(WER)을 기록하며, Whisper Small(3.74% / 7.95%)보다 높은 정확도를 보였습니다.
  • 속도: SpeechAnalyzer는 Whisper Small 대비 약 3배 빠른 처리 속도를 나타냈습니다.
  • 비교 우위: 기존의 SFSpeechRecognizer는 깨끗한 음성에서 9.02%의 WER을 기록하며 가장 낮은 성능을 보였습니다.

결론 및 시사점:

  • 영어 음성 인식에 있어 Apple 하드웨어(iOS/macOS)를 사용하는 경우, SpeechAnalyzer가 Whisper보다 정확도와 속도 면에서 모두 우위에 있습니다.
  • 다만, Whisper는 Apple 플랫폼 외의 환경에서도 작동하며 훨씬 더 많은 언어를 지원한다는 범용성 측면의 장점이 있습니다.
  • 이번 결과는 온디바이스 AI 모델의 최적화가 하드웨어 가속과 결합했을 때 얼마나 강력한 성능을 낼 수 있는지 보여주는 사례입니다.

이 요약은 원문 이해를 돕기 위한 큐레이션입니다. 저작권은 원저작자에게 있으며, 정확한 내용과 맥락은 원문을 확인하세요.

요약 오류, 출처 표기 문제, 삭제 요청은 문의 · 건의로 알려주세요.