AI Briefing

World Labs, 공간 지능 특화 옴니 월드 모델 'Atlas' 공개

·2026.09.02 09:00

핵심 내용

World Labs가 텍스트, 이미지, 3D를 통합 처리하는 공간 지능 특화 옴니 월드 모델 Atlas를 공개했다.

자세히 보기

World Labs가 2026년 9월 1일, 공간 지능(spatial intelligence)을 목표로 하는 새로운 옴니 월드 모델 Atlas를 공개했다. Atlas는 텍스트, 이미지, 비디오, 3D 데이터를 네이티브로 처리하도록 처음부터 사전 학습된 모델로, 모든 입력을 공유된 공간 컨텍스트로 결합하여 3D 일관성을 유지하며 세계를 생성하고 시뮬레이션한다.

아키텍처 및 핵심 기능

Atlas는 multimodal autoregressive diffusion transformer 구조를 채택했다. 각 이미지는 3D 공간 내 특정 위치에 기반하여 컨텍스트를 형성하며, 모델은 이를 조건으로 다음 프레임을 생성한다. 주요 기능으로는 정밀한 카메라 기하학을 입력으로 받아 최대 1분 길이의 1440p 비디오를 생성하는 Camera-Controlled Generation, 희소 입력 이미지로부터 고품질 3D 장면을 재구성하는 3D Reconstruction, 그리고 일반 스마트폰 영상으로 '불릿 타임' 효과를 구현하거나 로봇 시뮬레이션을 위한 Real-to-Sim 데이터를 생성하는 World Simulation 등이 있다.

성능 및 벤치마크

Atlas는 전문화된 모델들보다 우수한 성능을 입증했다. 카메라 제어 생성 평가에서는 Gemini Omni Flash, FLUX 3 등 최신 비디오 모델 대비 높은 선호도를 기록했다. 특히 복잡한 카메라 궤적일수록 그 우위가 두드러진다. 3D 재구성 벤치마크(AbsRel)에서는 Pi3X, VGGT-Ω 1B 등 최상의 오픈소스 모델들보다 낮은 오차율을 보이며, 평균 AbsRel 8.6(×10⁻³)을 달성했다.

확장성 및 전망

Atlas는 대규모 멀티모달 데이터로 사전 학습되었으며, 모델 크기와 학습 연산량을 증가시킬수록 새로운 기능이 해금되는 스케일링 특성을 보인다. World Labs는 이러한 추세가 지속되어 미래 월드 모델의 성능이 극적으로 향상될 것으로 예상한다. 현재 Atlas는 얼리 액세스 단계로 제공되며, 향후 Marble 등 World Labs의 제품 라인업을 구동하는 핵심 엔진으로 활용될 예정이다.

이 한국어 요약은 AI가 자동으로 만들었습니다. 원문의 주장과 맥락은 원문에서 확인해 주세요. 저작권은 원저작자에게 있습니다.

AI 처리 방식을 확인하거나, 요약 오류와 출처 표기 문제, 삭제 요청을 문의 · 건의로 알려주세요.