AI Briefing

FOSS vs SOTA 장문 벤치마크

Recent FOSS vs SOTA - Long Context Benchmark

·2026.05.03 01:01

Artificial Analysis의 Long Context 벤치마크로 FOSS와 SOTA를 비교했다.

Artificial Analysis Long Context Reasoning 벤치마크 차트로 최근 FOSSSOTA 모델을 비교했다.

이 평가는 10k~100k 토큰 규모의 문서를 읽고, 여러 문서에 흩어진 정보를 조합해 답하는 다문서·다단계 추론을 측정한다.

  • 장문 입력에서의 추론 성능 차이를 정량 비교하는 자료다.
  • 오픈 웨이트와 최상위 상용 모델의 격차를 함께 볼 수 있다.

이 요약은 원문 이해를 돕기 위한 큐레이션입니다. 저작권은 원저작자에게 있으며, 정확한 내용과 맥락은 원문을 확인하세요.

요약 오류, 출처 표기 문제, 삭제 요청은 문의 · 건의로 알려주세요.