오픈소스 30B, GPT-5.5 제친다
VibeWorlding benchmark: open 30B model tops GPT-5.5 on 3D worlds
·2026.08.18 20:34
핵심 내용
오픈소스 30B 모델이 VibeWorlding 벤치마크에서 GPT-5.5를 능가하며 3D 월드 생성의 새로운 기준을 제시했다.
자세히 보기
Yansong Ning 연구팀이 발표한 VibeWorlding 벤치마크는 멀티모달 에이전트가 자연어 프롬프트로 3D 오픈 월드를 엔드투엔드로 구축할 수 있는지를 평가한다.
GPT-5.5와 Qwen3.8-Max 등 최첨단 프런티어 모델들은 이 과제에서 60% 미만의 성공률(Pass@1)을 기록해, 정밀한 3D 월드 편집이 여전히 주요 병목임을 드러냈다.
반면, VibeWorlder-30B-A3B라는 오픈웨이트 30B 모델은 검증 가능한 보상을 기반으로 한 강화학습을 통해 평가 대상 모델 중 최고의 Pass@1을 달성했다.
이 결과는 단순한 파라미터 규모가 아닌, 샌드박스 도구와 검증기를 활용한 RL(강화학습) 접근이 3D 콘텐츠 생성 성능을 크게 향상시킬 수 있음을 시사한다.
이 한국어 요약은 AI가 자동으로 만들었습니다. 원문의 주장과 맥락은 원문에서 확인해 주세요. 저작권은 원저작자에게 있습니다.