Kimi K2.6가 코딩 챌린지에서 Claude, GPT-5.5, Gemini를 이김
·2026.05.04 09:50
Moonshot AI의 Kimi K2.6가 AI 코딩 챌린지에서 GPT-5.5와 Claude를 제치고 우승했다.
Moonshot AI의 오픈 가중치 모델 Kimi K2.6가 'AI Coding Contest'의 Word Gem Puzzle 부문에서 우승을 차지했다. 이번 대회에서는 주요 빅테크의 모델들을 제치고 중국계 모델들이 상위권을 휩쓸었다.
대회 결과 및 순위:
- 1위: Kimi K2.6 (Moonshot AI)
- 2위: MiMo V2-Pro (Xiaomi)
- 3위: GPT-5.5 (OpenAI)
- 4위: GLM 5.1 (Zhipu AI)
- 5위: Claude Opus 4.7 (Anthropic)
Word Gem Puzzle은 슬라이딩 타일 방식의 문자 퍼즐로, 격자 내에서 긴 영어 단어를 찾아낼수록 높은 점수를 얻는 규칙을 가지고 있다. 격자 크기가 커질수록(최대 30x30) 기존 단어들이 무작위로 섞이기 때문에, 단순히 기존 단어를 찾는 것을 넘어 타일을 능동적으로 움직여 새로운 단어를 만들어내는 능력이 중요하다.
모델별 전략 차이:
- Kimi K2.6: 새로운 단어를 열기 위해 타일을 계속 밀어내는 탐욕적 슬라이딩(Greedy Sliding) 전략을 사용하여 가장 높은 점수를 기록했다.
- MiMo V2-Pro & Claude: 타일을 직접 움직이지 않고 초기 격자에서 단어를 찾는 정적 스캐닝 방식에 의존했다. 이 방식은 작은 격자에서는 유효했으나, 30x30 격자에서는 더 이상 단어를 확보하지 못하며 한계를 드러냈다.
- GPT-5.5: 무한 루프를 방지하는 보수적인 슬라이딩 방식을 사용하여 큰 격자에서 강점을 보였다.
이번 결과는 특정 퍼즐에서의 성과이지만, 오픈 가중치 모델인 Kimi K2.6가 주요 폐쇄형 모델들과 대등한 수준의 성능을 보여주며 모델 간 경쟁 구도가 더욱 좁아지고 있음을 시사한다.
이 요약은 원문 이해를 돕기 위한 큐레이션입니다. 저작권은 원저작자에게 있으며, 정확한 내용과 맥락은 원문을 확인하세요.
요약 오류, 출처 표기 문제, 삭제 요청은 문의 · 건의로 알려주세요.