Grok 4.6 공개
핵심 내용
xAI가 장기 실행 에이전트와 시각·인터랙티브 작업을 강화한 Grok 4.6을 공개했다.
자세히 보기
xAI가 장기 실행 에이전트와 복잡한 인터랙티브·시각 작업에 초점을 맞춘 Grok 4.6을 공개했다. 여러 단계에 걸친 조사, 정보 분석, 코드베이스 작업, 애플리케이션 및 업무 산출물 제작을 지속적으로 수행하는 데 강점을 보인다.
Grok 4.6은 Artificial Analysis Intelligence Index에서 61점을 기록해 GPT-5.6 Sol과 동률을 이뤘다. GDPVal-AA v2는 1753점, CursorBench v3.2는 69.9%, DeepSWE v1.1은 65.9%를 기록했으며, 경쟁 모델 수치는 각 개발사가 공개한 시스템 카드와 벤치마크 리더보드 기준이다.
모델은 Grok 4.5보다 긴 추가 학습을 거쳤다. 추론과 고급 기술 개념, 고품질 엔지니어링 데이터로 기반을 강화한 뒤, Grok 4.5로 생성한 SFT 궤적을 STEM·소프트웨어 엔지니어링·지식 업무 등 다양한 영역에서 재구성하고 모델 기반 검사를 거쳐 필터링했다.
강화학습에는 일반 코딩과 지식 업무뿐 아니라 커널 최적화, 웹 개발, CAD 등 도메인별 에이전트 환경이 포함됐다. 제품 아이디어를 구조화하고 핵심 상호작용을 구현한 뒤 여러 차례 피드백을 반영하며 개선할 수 있고, 긴 작업 과정에서는 자체 테스트와 검증도 수행한다.
Grok 4.6은 현재 Cursor와 Grok Build에서 사용할 수 있다. 출시 첫 주에는 두 서비스에서 포함 사용량을 2배로 제공한다.
이 한국어 요약은 AI가 자동으로 만들었습니다. 원문의 주장과 맥락은 원문에서 확인해 주세요. 저작권은 원저작자에게 있습니다.