AI Briefing

ViiTorVoice-NAR 공개, 부분 음성 편집 지원

I work on an open-source TTS model with local speech editing — curious how people here would use it

·2026.09.18 19:31

핵심 내용

부분 음성 편집을 지원하는 오픈소스 TTS 모델 ViiTorVoice-NAR가 공개되었다.

자세히 보기

오픈소스 TTS 모델 ViiTorVoice-NAR가 공개되었다. 이 모델의 핵심 특징은 전체 오디오를 다시 생성하지 않고 **부분 음성 편집(local speech editing)**을 지원한다는 점이다.

기존 TTS 워크플로에서는 녹음 후 일부 단어 수정이 필요할 경우 문장 전체를 재생성해야 했지만, ViiTorVoice-NAR는 변경된 부분만 재생성하여 원본 오디오의 자연스러움을 유지한다. 현재 평가 결과 중국어 기준 WER(단어 오류율) 0.99를 기록했으며, 모델과 추론 코드는 GitHub에서 오픈소스로 공개되었다.

이 한국어 요약은 AI가 자동으로 만들었습니다. 원문의 주장과 맥락은 원문에서 확인해 주세요. 저작권은 원저작자에게 있습니다.

AI 처리 방식을 확인하거나, 요약 오류와 출처 표기 문제, 삭제 요청을 문의 · 건의로 알려주세요.