kimodo.cpp, PyTorch 없는 C++ 이식 공개
kimodo.cpp: NVIDIA Kimodo 모션 생성 모델을 PyTorch 없이 실행하는 C++/GGML 이식 구현
핵심 내용
NVIDIA Kimodo 모션 생성 모델을 PyTorch 없이 C++/GGML로 구현한 kimodo.cpp가 공개되어 로컬 추론 환경이 간소화된다.
자세히 보기
NVIDIA의 텍스트 기반 3D 모션 생성 모델 Kimodo를 PyTorch와 Python 런타임 없이 **C++**와 GGML만으로 재구현한 오픈소스 프로젝트 kimodo.cpp가 공개되었습니다. 이 구현은 단일 실행 파일로 UTF-8 프롬프트를 받아 SMPL-X 22 골격의 관절 회전값과 루트 이동값을 생성하며, CPU와 Vulkan GPU 모두에서 동일한 결과를 보장하는 대조 테스트를 제공합니다.
기존 llama.cpp 전체를 링크하지 않고 GGML과 GGUF에만 직접 연결하여, 텍스트 인코더에 필요한 비인과(Bi-directional) 어텐션과 평균 풀링 연산을 직접 작성했습니다. 이를 통해 인과적(Causal) 방식의 기존 런타임과 충돌 없이 정확한 추론이 가능합니다. 또한 텍스트 인코더와 디노이저를 순차적으로 로드하는 방식을 채택해 GPU 메모리 사용량을 원본 파이썬 구현보다 낮추는 메모리 최적화를 적용했습니다.
현재는 Kimodo-SMPLX-RP-v1 체크포인트를 지원하며, 제약 조건, SOMA 체크포인트, GLB 내보내기, 양자화 모델 지원은 향후 업데이트 예정으로 명시되어 있습니다. 원본과의 수치적 일치를 검증하기 위해 고정된 테스트 데이터와 메타데이터를 기반으로 한 엄격한 대조 테스트 스위트를 포함하고 있습니다.
이 한국어 요약은 AI가 자동으로 만들었습니다. 원문의 주장과 맥락은 원문에서 확인해 주세요. 저작권은 원저작자에게 있습니다.