AI Briefing

xAI, Grok 4.3 공개

·2026.05.01 09:00

xAI가 Grok 4.3을 공개하며 벤치마크 점수와 비용 효율을 함께 높였다.

xAI가 Grok 4.3을 공개했다. Artificial Analysis Intelligence Index에서 53점을 받아 Muse SparkClaude Sonnet 4.6을 앞섰고, 직전 버전인 Grok 4.20 0309 v2보다 4점 높다.

비용 효율도 개선됐다. 전체 벤치마크를 돌리는 데 드는 비용은 $395로, Grok 4.20 0309 v2보다 약 20% 낮다. 이는 입력 토큰 가격 37.5% 인하출력 토큰 가격 58.3% 인하의 영향이며, 출력 토큰은 약 44% 더 쓰지만 같은 지능대에서 여전히 저렴한 편이다.

실사용 에이전트 성능에서는 GDPval-AA가 가장 크게 뛰었다.

  • ELO 1500으로, 이전 버전의 1179보다 321점 상승했다.
  • Gemini 3.1 Pro Preview, Muse Spark, GPT-5.4 mini (xhigh), Kimi K2.5를 넘어섰지만, **GPT-5.5 (xhigh)**에는 276점 뒤진다.
  • 표준 Elo 기준 예상 승률은 **약 17%**다.

다른 평가에서는 𝜏²-Bench Telecom이 **98%**로 5점 올랐고, IFBench는 **81%**를 유지했다. 반면 AA-Omniscience Accuracy는 8점 올랐지만 Non-Hallucination Rate가 8점 낮아져, 지식 정확도와 환각 억제 사이의 균형은 여전히 완벽하지 않다. 결과적으로 Grok 4.3은 지능 대비 비용의 Pareto frontier에 올라섰다.

이 요약은 원문 이해를 돕기 위한 큐레이션입니다. 저작권은 원저작자에게 있으며, 정확한 내용과 맥락은 원문을 확인하세요.

요약 오류, 출처 표기 문제, 삭제 요청은 문의 · 건의로 알려주세요.