Grok 4.1
·2025.11.17 00:00
xAI가 감성 지능과 창의적 능력을 대폭 강화한 Grok 4.1을 출시했다.
Grok 4.1이 grok.com, X, 그리고 iOS 및 Android 앱을 통해 모든 사용자에게 공개되었다. 이번 모델은 기존의 날카로운 지능과 신뢰성을 유지하면서도, 창의적이고 감성적이며 협업 중심적인 상호작용 능력을 대폭 개선했다.
xAI는 모델의 스타일, 성격, 유용성 및 정렬(alignment)을 최적화하기 위해 Reinforcement Learning 인프라를 활용했다. 특히 검증하기 어려운 보상 신호를 최적화하기 위해, 최첨단 agentic reasoning models를 보상 모델로 사용하여 응답을 자율적으로 평가하고 반복하는 새로운 방식을 도입했다.
주요 성능 지표는 다음과 같다:
- LMArena Text Leaderboard: Grok 4.1 Thinking(
quasarflux) 모델이 1483 Elo로 전체 1위를 차지했으며, 비추론 모드인tensor모델 역시 1465 Elo로 2위에 올랐다. - EQ-Bench: 감성 지능(EQ)을 측정하는 벤치마크를 통해 공감 능력과 대인 관계 기술의 향상을 입증했다.
- Creative Writing v3: 창의적 글쓰기 분야에서도 높은 성능을 기록했다.
Grok 4.1은 이전 모델 대비 사용자 선호도 조사에서 **64.78%**의 높은 선호도를 기록하며 압도적인 성능 향상을 보여주었다.
이 요약은 원문 이해를 돕기 위한 큐레이션입니다. 저작권은 원저작자에게 있으며, 정확한 내용과 맥락은 원문을 확인하세요.
요약 오류, 출처 표기 문제, 삭제 요청은 문의 · 건의로 알려주세요.