AI Briefing

ElevenLabs, 의료 특화 음성 인식 모델 'Scribe v2 Medical' 일반 공개

·2026.09.22 21:00

핵심 내용

ElevenLabs가 의료 음성 인식 특화 모델 Scribe v2 Medical을 공개해 임상 오디오 WER을 18% 개선했다.

자세히 보기

ElevenLabs가 임상 오디오에 특화된 음성 인식 모델 Scribe v2 Medical을 ElevenAPI를 통해 일반 공개(GA)했다. 이 모델은 의료 ASR 벤치마크에서 가장 낮은 단어 오류율(WER)을 기록했으며, 기존 Scribe v2 대비 임상 오디오 WER을 18% 감소시켰다.

벤치마크 성능 및 정확도

Eka Medical ASR 벤치마크(3,619개 샘플)에서 Scribe v2 Medical은 WER **7.0%**를 기록해 Base 모델(8.6%)보다 1.6pp 개선됐다. 10,000회 재구성 테스트를 통해 통계적 유의성이 검증되었다. Omi Health 벤치마크(1,513개 클립)에서는 30개 시스템 중 최저인 전체 WER **5.88%**를 달성했으며, 용량(dosage) 인식 정확도는 79.8%에서 **86.2%**로 향상됐다.

의료 용어 단독 평가에서는 오류가 14% 감소(11.1% → 9.5%)했다. 특히 문장 내 용어 인식 시 WER이 **7.5%**까지 낮아졌으나, 맥락이 없는 고립된 단일 단어 인식은 여전히 WER **14.3%**로 어려운 과제로 남아 있다. 이를 보완하기 위해 약물명 등을 강조하는 keyterm prompting 기능을 제공한다.

비의료 성능 유지 및 보안

의료 특화 파인튜닝이 비의료 영역 성능을 저하시키지 않음을 검증했다. CommonVoice 기반 일상 음성 샘플에서 Base 모델과 동일한 5.3% WER을 유지했다. 또한 HIPAA 준수를 위해 BAA 체결 및 **Zero Retention Mode(ZRM)**를 활성화한 엔터프라이즈 고객에게 오디오 및 텍스트 데이터를 즉시 삭제하는 방식을 적용한다. 사용자는 API에서 모델 ID scribe_v2_medical을 지정해 호출할 수 있다.

이 한국어 요약은 AI가 자동으로 만들었습니다. 원문의 주장과 맥락은 원문에서 확인해 주세요. 저작권은 원저작자에게 있습니다.

AI 처리 방식을 확인하거나, 요약 오류와 출처 표기 문제, 삭제 요청을 문의 · 건의로 알려주세요.