vdn-minimax-h3: 14초 영상 생성에 11초, 하이브리드 어텐션으로 속도 극대화
OpenVDN/vdn-minimax-h3
·2026.09.04 02:23
프로젝트 소개
MiniMax H3 기반의 하이브리드 어텐션 구조를 적용해 영상 생성 속도를 대폭 개선했다. B200 GPU 8개 환경에서 14.4초 분량의 영상을 11.23초 만에 만들어내며, 재생 시간보다 빠른 추론 속도를 기록한다.
프레임 단위 선형 어텐션과 Softmax 어텐션을 결합한 아키텍처가 핵심이다. 기존 백본의 시각적 품질과 일관성을 유지하면서 연산 효율을 높였으며, 별도 선형 어텐션 브랜치와 LoRA 어댑터를 추가하는 플러그 앤 플레이 방식으로 구현됐다.
가속화된 추론 스택과 학습 코드를 모두 공개해 연구 및 개발 환경에서 즉시 활용 가능하다. FP8 양자화를 지원하며, 8단계 디노이징으로 50단계 모델 대비 압도적인 속도 향상을 달성했다.
다만 라이선스 적용 범위에 주의가 필요하다. MiniMax H3 커뮤니티 라이선스에 따라 한국, 미국, 유럽 등 특정 지역에서는 사용이 제한될 수 있으므로 배포 전 약관 확인이 필수다.
HuggingFace 모델
OpenVDN/vdn-minimax-h3
원문에 등록된 설명이 없습니다.
text-to-video
이 한국어 소개글은 AI가 자동으로 만들었습니다. 원문의 주장과 맥락은 원문에서 확인해 주세요. 저작권은 원저작자에게 있습니다.

