알리바바 AI 비디오 모델, OpenAI Sora와 ByteDance Seedance를 제치고 글로벌 순위 2위로 도약
알리바바가 출시한 HappyHorse 1.1이 벤치마크에서 상위권을 기록하며 AI 비디오 시장의 새로운 강자로 부상했다.
알리바바 클라우드가 기업용 비디오 생성 모델인 HappyHorse 1.1을 출시했다. 이 모델은 단순한 데모를 넘어 기업의 워크플로우에 즉시 통합 가능한 API-first 제품으로, 출시를 기념해 2주간 40% 할인 혜택을 제공한다.
최근 AI 비디오 시장은 OpenAI의 Sora가 수익성 문제로 중단되고, ByteDance의 Seedance 2.0이 저작권 문제로 국제 출시를 무기한 연기하며 급격한 변화를 맞이하고 있다. 이러한 공백 속에서 HappyHorse는 강력한 기술력을 바탕으로 시장 점유율을 확대할 기회를 잡았다.
Artificial Analysis Video Arena의 벤치마크 결과, HappyHorse는 text-to-video 및 image-to-video 부문에서 모두 최상위권을 기록하며 Google의 Veo-3.1과 xAI의 Grok-Imagine-Video를 앞질렀다. 이는 단순한 통계적 우연이 아닌, 실제 사용자 평가(Elo rating)를 통해 입증된 품질 차이다.
기술적 핵심은 150억 개의 파라미터를 가진 unified self-attention Transformer 아키텍처에 있다. 텍스트, 이미지, 비디오, 오디오 토큰을 하나의 시퀀스로 처리하는 통합 시스템을 구축하여, 별도의 오디오 편집 도구 없이도 단 한 번의 생성 과정(single generation pass)으로 모든 모달리티를 처리한다.
이번 1.1 업데이트의 주요 특징은 다음과 같다:
- R2V (Reference-to-Video): 여러 장의 캐릭터 참조 이미지를 사용하여 영상 내 인물의 정체성을 일관되게 유지하는 기능.
- 강화된 모션 모델링: 기존 모델의 한계였던 움직임의 품질 문제를 개선.
- 상업적 최적화: 소셜 미디어용 데모가 아닌, 광고 및 콘텐츠 제작을 위한 실무 중심의 최적화 수행.
이 요약은 원문 이해를 돕기 위한 큐레이션입니다. 저작권은 원저작자에게 있으며, 정확한 내용과 맥락은 원문을 확인하세요.
요약 오류, 출처 표기 문제, 삭제 요청은 문의 · 건의로 알려주세요.