AI Briefing
추천

SpaceXAI의 Grok 4.6, Artificial Analysis Intelligence Index에서 61점 기록

·2026.08.13 01:54

핵심 내용

Grok 4.6이 낮은 비용으로 frontier급 지능과 에이전트 성능을 기록했다.

자세히 보기

Artificial Analysis 평가에서 Grok 4.6이 Intelligence Index 61점을 기록하며 frontier 모델군에 합류했다. 이는 GPT-5.6 Sol과 같은 점수로, Claude Opus 5(63점)와 Claude Fable 5(62점)에 이어지는 수준이다. Grok 4.5보다 5점, Grok 4.3보다 23점 상승했다.

에이전트 작업에서 특히 강한 성능을 보였다.

  • GDPval-AA v2: Elo 1753으로 Claude Opus 5에 이어 2위권
  • τ³-Banking: 50.7%로 상위권
  • Terminal-Bench v2.1: 88.4%로 선두 모델들과 비슷한 수준
  • AA-Briefcase: Elo 1577로 Claude Fable 5급 성능

API 가격은 Grok 4.5와 동일한 입력 100만 토큰당 2달러, 출력 100만 토큰당 6달러다. Claude Opus 5($5/$25)와 GPT-5.6 Sol($5/$30)보다 저렴하며, 측정된 작업당 비용은 0.84달러로 집계됐다. 캐시 적중 토큰 가격은 100만 토큰당 0.5달러다.

컨텍스트 윈도우는 500K 토큰이다. AA-Briefcase에서 평균 약 53턴, 입력 5억 토큰으로 작업을 완료해 Claude Opus 5(max)의 약 103턴, 20억 입력 토큰보다 토큰 효율이 높았다.

이 한국어 요약은 AI가 자동으로 만들었습니다. 원문의 주장과 맥락은 원문에서 확인해 주세요. 저작권은 원저작자에게 있습니다.

AI 처리 방식을 확인하거나, 요약 오류와 출처 표기 문제, 삭제 요청을 문의 · 건의로 알려주세요.