Qwen3.8 Max, Agentic Index 종합 1위
·2026.08.07 07:34
핵심 내용
Qwen3.8 Max가 Artificial Analysis의 Agentic Index 종합 1위에 올랐다.
자세히 보기
Qwen3.8 Max가 Artificial Analysis의 Agentic Index에서 종합 1위를 기록했다.
Artificial Analysis는 Intelligence Index v4.1.1에서 다음 9개 평가를 종합해 주요 AI 모델의 지능 수준을 비교한다.
- GDPval-AA v2
- τ³-Banking
- Terminal-Bench v2.1
- SciCode
- Humanity’s Last Exam
- GPQA Diamond
- CritPt
- AA-Omniscience
- AA-LCR
이번 업데이트에서는 τ³-Banking을 v1.0.1로 변경하고, HLE·AA-LCR·AA-Omniscience 평가의 채점기를 **GPT-5.6 Luna (medium)**로 업그레이드했다.
사이트는 모델별 지능 점수, 출력 속도, Intelligence Index 작업당 비용을 함께 제공하며, 오픈 웨이트 모델과 독점 모델 비교 및 성능·비용의 Pareto 분석도 지원한다. 또한 동일 모델을 제공하는 엔드포인트 간 품질 차이를 측정하는 Endpoint Accuracy Index를 새로 공개했다.
이 한국어 요약은 AI가 자동으로 만들었습니다. 원문의 주장과 맥락은 원문에서 확인해 주세요. 저작권은 원저작자에게 있습니다.