dots3-note-prev: 500B 미만 모델 1위, MMMU-Pro 79.1% 달성한 dots3-note
dots-studio/dots3-note-prev
프로젝트 소개
dots-studio의 dots3-note 모델 라인업에서 공개된 프리뷰 버전이다. 텍스트 생성을 기반으로 이미지, 오디오, 비디오 입력을 함께 처리하는 멀티모달 LLM으로 분류된다. Apache-2.0 라이선스로 배포되어 상용 환경에서의 활용이 가능하다.
장문 컨텍스트(long-context) 처리와 에이전틱(agentic) 작업 수행을 주요 특징으로 내세운다. 대화형 인터페이스를 지원하며, 도구 호출(tool calling) 기능을 통해 외부 API나 함수를 실행하는 워크플로우를 자동화할 수 있다. 복잡한 추론 과정이 필요한 코드 작성 및 문제 해결 작업에 특화되어 있다.
공개된 벤치마크 결과에 따르면 SWE-bench Verified에서 78.4%, SWE-bench Pro에서 61%의 점수를 기록했다. 멀티모달 이해력을 측정하는 MMMU-Pro에서는 79.1%를 달성했으며, 이는 500B 파라미터 미만의 모델 중 1위를 차지한 수치다. 또한 WildClawBench 종합 점수에서도 61.7%로 동급 모델 중 최상위권 성적을 보였다.
소프트웨어 엔지니어링 자동화, 복잡한 멀티모달 데이터 분석, 그리고 도구 기반 에이전트 시스템 구축을 계획 중인 개발자에게 적합하다. 특히 코드 수정 및 버그 해결(SWE-bench) 성능이 검증된 만큼, CI/CD 파이프라인이나 코드 리뷰 보조 도구로 활용 가치가 있다. Transformers 라이브러리를 통해 직접 추론을 실행하거나, Hugging Face Inference Endpoints를 통해 API 형태로 서비스화할 수 있다.
dots-studio/dots3-note-prev
원문에 등록된 설명이 없습니다.
image-text-to-text
이 한국어 소개글은 AI가 자동으로 만들었습니다. 원문의 주장과 맥락은 원문에서 확인해 주세요. 저작권은 원저작자에게 있습니다.




