AI Briefing

Eleven v3 출시

·2026.04.10 14:58

ElevenLabs가 오디오 태그와 멀티 스피커 기능을 갖춘 Eleven v3를 공개했다.

ElevenLabs가 더욱 풍부한 표현력을 제공하는 Eleven v3를 정식 출시했다. 이번 모델은 단순한 음질 개선을 넘어 감정의 고조, 대화 중 끼어들기, 자연스러운 상호작용 등 기존 모델의 한계였던 '표현력' 문제를 해결하는 데 집중했다.

주요 업데이트 사항은 다음과 같다:

  • 오디오 태그(Audio tags): [excited], [whispers], [sighs] 등의 태그를 사용하여 톤, 감정, 비언어적 반응을 세밀하게 제어할 수 있다.
  • 대화 모드(Dialogue mode): 여러 화자가 자연스러운 호흡과 끼어들기를 포함해 대화하는 기능을 지원한다.
  • 70개 이상의 언어 지원: 글로벌 수요가 높은 다양한 언어를 지원한다.
  • 텍스트 이해도 향상: 입력된 텍스트의 강조점과 리듬을 더 정확하게 파악한다.

새롭게 도입된 Text to Dialogue API를 사용하면 JSON 객체 배열을 통해 화자별 대화 순서를 구조화할 수 있으며, 모델이 화자 전환과 감정 변화를 자동으로 처리한다.

다만, Eleven v3는 이전 모델보다 정교한 프롬프트 엔지니어링이 요구되며, 높은 지연 시간(latency)으로 인해 실시간 대화용보다는 영상 제작이나 오디오북 등 미디어 제작 환경에 최적화되어 있다. 실시간 서비스에는 v2.5 Turbo 또는 Flash 모델 사용이 권장된다.

이 요약은 원문 이해를 돕기 위한 큐레이션입니다. 저작권은 원저작자에게 있으며, 정확한 내용과 맥락은 원문을 확인하세요.

요약 오류, 출처 표기 문제, 삭제 요청은 문의 · 건의로 알려주세요.