AI Briefing

오픈소스 30B, GPT-5.5 제친다

VibeWorlding benchmark: open 30B model tops GPT-5.5 on 3D worlds

·2026.08.18 20:34

핵심 내용

오픈소스 30B 모델이 VibeWorlding 벤치마크에서 GPT-5.5를 능가하며 3D 월드 생성의 새로운 기준을 제시했다.

자세히 보기

Yansong Ning 연구팀이 발표한 VibeWorlding 벤치마크는 멀티모달 에이전트가 자연어 프롬프트로 3D 오픈 월드를 엔드투엔드로 구축할 수 있는지를 평가한다.

GPT-5.5와 Qwen3.8-Max 등 최첨단 프런티어 모델들은 이 과제에서 60% 미만의 성공률(Pass@1)을 기록해, 정밀한 3D 월드 편집이 여전히 주요 병목임을 드러냈다.

반면, VibeWorlder-30B-A3B라는 오픈웨이트 30B 모델은 검증 가능한 보상을 기반으로 한 강화학습을 통해 평가 대상 모델 중 최고의 Pass@1을 달성했다.

이 결과는 단순한 파라미터 규모가 아닌, 샌드박스 도구와 검증기를 활용한 RL(강화학습) 접근이 3D 콘텐츠 생성 성능을 크게 향상시킬 수 있음을 시사한다.

이 한국어 요약은 AI가 자동으로 만들었습니다. 원문의 주장과 맥락은 원문에서 확인해 주세요. 저작권은 원저작자에게 있습니다.

AI 처리 방식을 확인하거나, 요약 오류와 출처 표기 문제, 삭제 요청을 문의 · 건의로 알려주세요.