AI Briefing

ElevenLabs, Scribe v2 Medical 정식 출시… 임상 오디오 WER 18% 감소

·2026.09.22 21:00

핵심 내용

ElevenLabs가 임상 오디오에 최적화된 Scribe v2 Medical을 정식 출시하며 의료 ASR 정확도를 대폭 개선했다.

자세히 보기

ElevenLabs가 Scribe v2 Medical을 ElevenAPI에서 정식 출시했다. 이 모델은 임상 오디오(clinical audio)에 특화되어 미세 조정(fine-tuned)되었으며, 기존 Base Scribe v2 대비 임상 오디오의 WER(word error rate)을 18% 감소시켰다.

벤치마크 성능

  • Omi Health 벤치마크: 30개 시스템 중 가장 낮은 전체 WER **5.88%**를 기록했으며, 용량(dosage) 인식 정확도는 **86.2%**로 Base 모델(79.8%)보다 향상되었다.
  • Eka Medical 벤치마크: 공개된 모든 결과보다 낮은 WER를 달성했다.
  • 다국어 성능: Corti의 MedDictate 벤치마크에서 Base 모델 대비 WER을 약 36% 상대적 감소시켰으며, 이는 세 가지 언어에서 일관되게 유지된다.

한계 및 해결 방안

컨텍스트가 없는 고립된 단어(isolated single-word clips) 인식은 여전히 어려운 과제로 남아 있다. 고립된 용어의 WER은 **14.3%**로, 문장 내 용어 WER(7.5%)보다 높다. 예를 들어 'etodolac'이 "It'll do the luck"으로 오인식되는 등의 오류가 발생한다. ElevenLabs는 keyterm prompting 기능을 통해 약물 명칭이나 의료 구문을 강조하여 이러한 오류를 줄일 수 있다고 밝혔다.

데이터 보안 및 사용법

의료 미세 조정은 비의료 음성 성능을 저하시키지 않으며, CommonVoice 테스트에서 Base 모델과 동일한 5.3% WER을 유지했다. HIPAA 호환성을 위해 BAA 체결 및 Zero Retention Mode(ZRM) 활성화 시 오디오와 텍스트 출력을 즉시 삭제하여 데이터를 보존하지 않는다. 사용자는 Speech to Text API에서 scribe_v2_medical 모델 ID를 지정하여 batch 엔드포인트를 통해 호출할 수 있다.

이 한국어 요약은 AI가 자동으로 만들었습니다. 원문의 주장과 맥락은 원문에서 확인해 주세요. 저작권은 원저작자에게 있습니다.

AI 처리 방식을 확인하거나, 요약 오류와 출처 표기 문제, 삭제 요청을 문의 · 건의로 알려주세요.