AI Briefing

새해를 화려하게 시작하라

·2026.04.10 14:58

핵심 내용

ElevenLabs가 성별, 연령, 억양 등을 직접 설정해 새로운 합성 음성을 설계할 수 있는 기능을 출시한다.

자세히 보기

생성형 AI 열풍 속에서 상대적으로 저평가된 voice AI 분야를 선점하기 위해 ElevenLabs가 새로운 솔루션을 선보인다. 기존의 제한된 스피커 뱅크를 넘어, 사용자가 처음부터 완전히 새로운 합성 음성을 직접 설계할 수 있는 Voice Generator를 도입한다.

이 기술은 목소리의 정체성을 담고 있는 벡터 표현인 speaker embeddings를 활용한다. ElevenLabs는 전용 모델을 통해 speaker embeddings의 분포에서 샘플링함으로써 무한히 많은 새로운 목소리를 생성할 수 있는 환경을 구축했다.

사용자는 다음과 같은 핵심 파라미터를 조정하여 목소리의 정체성을 제어할 수 있다:

  • 성별(Gender), 연령(Age), 억양(Accent)
  • 피치(Pitch), 말하기 스타일(Speaking style)

이 기능은 다양한 산업 분야에서 활용될 전망이다. 도서 저자는 맞춤형 내레이션을 제작할 수 있고, 뉴스 발행사는 브랜드 고유의 목소리를 확보할 수 있다. 또한 게임 개발자는 NPC에게 독특한 음성을 부여할 수 있으며, 광고 제작자는 캠페인에 최적화된 내레이션을 즉각적으로 실험할 수 있다.

해당 기능은 오는 2월 Voice Lab의 일부로 플랫폼에 출시될 예정이다.

이 한국어 요약은 AI가 자동으로 만들었습니다. 원문의 주장과 맥락은 원문에서 확인해 주세요. 저작권은 원저작자에게 있습니다.

AI 처리 방식을 확인하거나, 요약 오류와 출처 표기 문제, 삭제 요청을 문의 · 건의로 알려주세요.