Kimi K2.6, 코딩 챌린지 우승
An open-weights Chinese model just beat Claude, GPT-5.5, and Gemini in a programming challenge
오픈웨이트 Kimi K2.6이 AI 코딩 챌린지에서 Claude·GPT-5.5를 제쳤다.
Rohana Rezel이 운영한 AI Coding Contest의 Day 12 Word Gem Puzzle에서 Kimi K2.6이 **22점(7-1-0)**으로 1위를 차지했다.
- MiMo V2-Pro가 20점으로 2위, GPT-5.5가 16점으로 3위, GLM 5.1이 15점으로 4위였다.
- Claude Opus 4.7은 12점으로 5위, Gemini Pro 3.1과 Grok Expert 4.2는 각각 9점으로 공동 6위였다.
- DeepSeek V4는 malformed output으로 사실상 유효한 플레이를 하지 못했고, Muse Spark는 짧은 단어를 무차별 주장해 본문 기준 누적 -15,309점까지 떨어졌다.
- Nemotron Super 3는 구문 오류 때문에 서버에 연결조차 되지 못했다.
퍼즐은 10x10~30x30 슬라이딩 타일 보드에서 가로·세로 단어를 주장하는 방식이며, 7글자 미만 단어는 감점된다. 작은 보드에서는 초기 seed word를 읽는 정적 스캐너도 버틸 수 있었지만, 30x30에서는 실제로 빈칸을 움직이며 단어를 복원하는 전략이 중요했다.
Kimi는 이동마다 새로 열리는 양의 점수 단어를 기준으로 다음 수를 고르는 탐욕적 슬라이딩을 택했고, 글은 이 방식이 큰 보드에서 성과를 냈다고 설명한다. 반대로 MiMo와 Claude는 대부분 슬라이드 없이 초기 그리드 의존형 전략을 썼고, GPT-5.5는 라운드당 약 120회 수준의 제한적 슬라이딩을 사용했다.
글은 이 결과를 단일 벤치마크로 과장하진 않지만, 오픈웨이트 모델이 프런티어 모델과의 격차를 빠르게 좁히고 있다는 신호로 해석한다.
이 요약은 원문 이해를 돕기 위한 큐레이션입니다. 저작권은 원저작자에게 있으며, 정확한 내용과 맥락은 원문을 확인하세요.
요약 오류, 출처 표기 문제, 삭제 요청은 문의 · 건의로 알려주세요.