ViiTorVoice-NAR 공개, 부분 음성 편집 지원
I work on an open-source TTS model with local speech editing — curious how people here would use it
·2026.09.18 19:31
핵심 내용
부분 음성 편집을 지원하는 오픈소스 TTS 모델 ViiTorVoice-NAR가 공개되었다.
자세히 보기
오픈소스 TTS 모델 ViiTorVoice-NAR가 공개되었다. 이 모델의 핵심 특징은 전체 오디오를 다시 생성하지 않고 **부분 음성 편집(local speech editing)**을 지원한다는 점이다.
기존 TTS 워크플로에서는 녹음 후 일부 단어 수정이 필요할 경우 문장 전체를 재생성해야 했지만, ViiTorVoice-NAR는 변경된 부분만 재생성하여 원본 오디오의 자연스러움을 유지한다. 현재 평가 결과 중국어 기준 WER(단어 오류율) 0.99를 기록했으며, 모델과 추론 코드는 GitHub에서 오픈소스로 공개되었다.
이 한국어 요약은 AI가 자동으로 만들었습니다. 원문의 주장과 맥락은 원문에서 확인해 주세요. 저작권은 원저작자에게 있습니다.