AI Briefing

xAI, Grok 4.3 공개

·2026.05.01 09:00

핵심 내용

xAI가 Grok 4.3을 공개하며 벤치마크 점수와 비용 효율을 함께 높였다.

1 / 2

자세히 보기

xAI가 Grok 4.3을 공개했다. Artificial Analysis Intelligence Index에서 53점을 받아 Muse Spark와 Claude Sonnet 4.6을 앞섰고, 직전 버전인 Grok 4.20 0309 v2보다 4점 높다.

비용 효율도 개선됐다. 전체 벤치마크를 돌리는 데 드는 비용은 $395로, Grok 4.20 0309 v2보다 약 20% 낮다. 이는 입력 토큰 가격 37.5% 인하와 출력 토큰 가격 58.3% 인하의 영향이며, 출력 토큰은 약 44% 더 쓰지만 같은 지능대에서 여전히 저렴한 편이다.

실사용 에이전트 성능에서는 GDPval-AA가 가장 크게 뛰었다.

  • ELO 1500으로, 이전 버전의 1179보다 321점 상승했다.
  • Gemini 3.1 Pro Preview, Muse Spark, GPT-5.4 mini (xhigh), Kimi K2.5를 넘어섰지만, **GPT-5.5 (xhigh)**에는 276점 뒤진다.
  • 표준 Elo 기준 예상 승률은 **약 17%**다.

다른 평가에서는 𝜏²-Bench Telecom이 **98%**로 5점 올랐고, IFBench는 **81%**를 유지했다. 반면 AA-Omniscience Accuracy는 8점 올랐지만 Non-Hallucination Rate가 8점 낮아져, 지식 정확도와 환각 억제 사이의 균형은 여전히 완벽하지 않다. 결과적으로 Grok 4.3은 지능 대비 비용의 Pareto frontier에 올라섰다.

이 한국어 요약은 AI가 자동으로 만들었습니다. 원문의 주장과 맥락은 원문에서 확인해 주세요. 저작권은 원저작자에게 있습니다.

AI 처리 방식을 확인하거나, 요약 오류와 출처 표기 문제, 삭제 요청을 문의 · 건의로 알려주세요.