FOSS vs SOTA 장문 벤치마크
Recent FOSS vs SOTA - Long Context Benchmark
·2026.05.03 01:01
핵심 내용
Artificial Analysis의 Long Context 벤치마크로 FOSS와 SOTA를 비교했다.
자세히 보기
Artificial Analysis Long Context Reasoning 벤치마크 차트로 최근 FOSS와 SOTA 모델을 비교했다.
이 평가는 10k~100k 토큰 규모의 문서를 읽고, 여러 문서에 흩어진 정보를 조합해 답하는 다문서·다단계 추론을 측정한다.
- 장문 입력에서의 추론 성능 차이를 정량 비교하는 자료다.
- 오픈 웨이트와 최상위 상용 모델의 격차를 함께 볼 수 있다.
이 한국어 요약은 AI가 자동으로 만들었습니다. 원문의 주장과 맥락은 원문에서 확인해 주세요. 저작권은 원저작자에게 있습니다.