AI Briefing

IBM, Granite 4.2 추론 LLM 공개: 3B~30B, 512K 컨텍스트 및 에이전틱 RL 적용

·2026.08.26 09:00

핵심 내용

IBM이 512K 컨텍스트와 에이전틱 RL을 적용한 Granite 4.2 추론 LLM 3종을 공개했다.

1 / 6

자세히 보기

IBM은 Granite 4.2 LLM 시리즈를 공개했다. 이번 버전은 3B, 8B, 30B 세 가지 크기의 밀집형(decoder-only) 추론 모델로 구성되며, 모든 모델은 Apache 2.0 라이선스로 배포된다.

모델은 약 15T 토큰의 데이터로 5단계 전략에 따라 처음부터 사전 학습되었다. 이 과정을 통해 컨텍스트 윈도우가 512K 토큰까지 확장되었다. 이후 체인 오브 스코트(CoT), 추론, 에이전트 궤적 데이터로 감독 미세 조정(SFT)을 거쳤다.

학습 파이프라인 및 기능

포스트 트레이닝 단계에서는 다단계 강화 학습(RL) 파이프라인이 적용되었다. 특히 8B와 30B 모델은 실제 샌드박스 환경에서 도구를 사용하여 행동하는 에이전틱 RL을 학습했다. 모든 모델은 작업 난이도에 따라 생각(thinking) 모드와 비생각(non-thinking) 모드를 전환할 수 있으며, 쉬운 질문에는 짧은 추론 예산을 사용하는 저노력(low-effort) 추론 모드를 지원한다. 또한 네이티브 도구 호출 기능이 내장되어 있다.

이 한국어 요약은 AI가 자동으로 만들었습니다. 원문의 주장과 맥락은 원문에서 확인해 주세요. 저작권은 원저작자에게 있습니다.

AI 처리 방식을 확인하거나, 요약 오류와 출처 표기 문제, 삭제 요청을 문의 · 건의로 알려주세요.