AI Briefing

Sapient Intelligence, HRM-Text 1B 공개

Sapient Intelligence releases HRM-Text 1B: 40B tokens, ~$1k pretrain, beats Llama3.2 3B on MATH and DROP

·2026.05.19 20:01

Sapient Intelligence가 적은 데이터와 비용으로 높은 추론 성능을 구현한 1B 모델 HRM-Text 1B를 출시했다.

Sapient Intelligence가 계층적 추론(Hierarchical Reasoning) 방식을 적용한 HRM-Text 1B 모델을 공개했다. 이 모델은 매우 적은 학습 데이터와 비용으로도 특정 추론 작업에서 뛰어난 성능을 보이는 것이 특징이다.

주요 학습 지표:

  • 파라미터 수: 1B
  • 학습 데이터: 40B 토큰 (기존 모델 대비 약 1/100~1/900 수준의 데이터 사용)
  • 학습 비용:$1,000
  • 학습 기간: 16개의 GPU로 1.9일 소요

벤치마크 성능: HRM-Text 1B는 다단계 추론이 필요한 벤치마크에서 강점을 보였다.

  • MATH: 56.2 (Llama3.2 3B의 48.0 상회)
  • DROP: 82.2 (Llama3.2 3B의 45.2 상회)

다만, 학습 데이터 양의 한계로 인해 지식 회상 능력을 측정하는 **MMLU(60.7)**에서는 Qwen3.5 2B나 Olmo3 7B보다 낮은 성능을 기록했다. 이는 모델이 방대한 세계 지식을 습득하기에는 40B 토큰이 부족했음을 보여준다.

참고 사항: 해당 수치는 개발사가 직접 보고한 결과이며, MATH 및 DROP 벤치마크의 특성상 데이터 오염(Contamination) 가능성에 대한 추가적인 검증이 필요할 수 있다.

이 요약은 원문 이해를 돕기 위한 큐레이션입니다. 저작권은 원저작자에게 있으며, 정확한 내용과 맥락은 원문을 확인하세요.

요약 오류, 출처 표기 문제, 삭제 요청은 문의 · 건의로 알려주세요.