VibeThinker-3B 공개: SLM의 수학·코딩 성능 혁신
Scaling former VibeThinker-1.5B to 3B — now it reaches frontier math & coding performance
·2026.06.16 22:44
소형 언어 모델(SLM)인 VibeThinker-3B가 수학 및 코딩 벤치마크에서 프론티어급 성능을 입증했다.
검증 가능한 추론(Verifiable Reasoning) 능력을 극대화하기 위해 학습된 VibeThinker-3B 모델이 공개되었습니다. 이 모델은 파라미터 규모가 작음에도 불구하고 특정 도메인에서 매우 높은 성능을 보여줍니다.
주요 벤치마크 성능:
- AIME'26: 94.3
- LiveCodeBench v6: 80.2
- IMO-AnswerBench: 76.4
- IFEval: 93.4
- LeetCode: 최근 미공개 컨테스트에서 Python 제출 건수 중 96.1%(128건 중 123건)를 통과
연구진은 이 모델을 통해 파라미터 밀도가 높은 도메인에서 **SLM(Small Language Model)**이 기존의 Scaling Law를 보완하며 프론티어급 추론 능력을 제공할 수 있는 경로를 제시했습니다. 다만, 일반적인 범용 사용 사례에서는 여전히 개선이 필요한 단계입니다.
이 요약은 원문 이해를 돕기 위한 큐레이션입니다. 저작권은 원저작자에게 있으며, 정확한 내용과 맥락은 원문을 확인하세요.
요약 오류, 출처 표기 문제, 삭제 요청은 문의 · 건의로 알려주세요.