AI Briefing

롱 컨텍스트(Long Context)

·2026.03.25 20:16

AI21 Labs가 유효 컨텍스트 길이를 극대화하고 비용 효율성을 높인 Jamba 1.5 모델을 발표했다.

Jamba 1.5 LargeMini 모델은 256K 토큰의 컨텍스트 창을 제공한다. 이는 이전 시리즈보다 32배 길며, 유사 규모의 경쟁 모델들보다 훨씬 긴 수준이다.

단순히 컨텍스트 길이를 늘리는 것보다 중요한 것은 모델이 이를 얼마나 유용하게 활용하느냐다. NVIDIA의 RULER 벤치마크는 모델이 85% 이상의 성능을 유지하는 **'유효 컨텍스트(effective length)'**를 측정하며, Jamba는 시장에서 가장 긴 유효 컨텍스트 창을 제공한다.

Jamba는 Mamba 아키텍처를 기반으로 구축되었다. 기존 Transformer 모델들이 긴 컨텍스트 처리를 위해 사용하는 희소 주의 집중(sparse attention) 방식은 답변 품질을 저하시키는 부작용이 있지만, Jamba는 이를 극복하여 높은 품질을 유지한다.

또한, Jamba 1.5는 긴 컨텍스트 처리 시에도 뛰어난 효율성을 보여준다.

  • 낮은 지연 시간(Latency) 및 우수한 경제성 유지
  • Jamba 1.5 Mini는 10K 컨텍스트 길이에서 가장 빠른 속도 기록

이 요약은 원문 이해를 돕기 위한 큐레이션입니다. 저작권은 원저작자에게 있으며, 정확한 내용과 맥락은 원문을 확인하세요.

요약 오류, 출처 표기 문제, 삭제 요청은 문의 · 건의로 알려주세요.