AI Briefing

Kimi K2.6, 코딩 챌린지 우승

An open-weights Chinese model just beat Claude, GPT-5.5, and Gemini in a programming challenge

·2026.05.01 07:42

오픈웨이트 Kimi K2.6이 AI 코딩 챌린지에서 Claude·GPT-5.5를 제쳤다.

Rohana Rezel이 운영한 AI Coding ContestDay 12 Word Gem Puzzle에서 Kimi K2.6이 **22점(7-1-0)**으로 1위를 차지했다.

  • MiMo V2-Pro20점으로 2위, GPT-5.516점으로 3위, GLM 5.115점으로 4위였다.
  • Claude Opus 4.712점으로 5위, Gemini Pro 3.1Grok Expert 4.2는 각각 9점으로 공동 6위였다.
  • DeepSeek V4는 malformed output으로 사실상 유효한 플레이를 하지 못했고, Muse Spark는 짧은 단어를 무차별 주장해 본문 기준 누적 -15,309점까지 떨어졌다.
  • Nemotron Super 3는 구문 오류 때문에 서버에 연결조차 되지 못했다.

퍼즐은 10x10~30x30 슬라이딩 타일 보드에서 가로·세로 단어를 주장하는 방식이며, 7글자 미만 단어는 감점된다. 작은 보드에서는 초기 seed word를 읽는 정적 스캐너도 버틸 수 있었지만, 30x30에서는 실제로 빈칸을 움직이며 단어를 복원하는 전략이 중요했다.

Kimi는 이동마다 새로 열리는 양의 점수 단어를 기준으로 다음 수를 고르는 탐욕적 슬라이딩을 택했고, 글은 이 방식이 큰 보드에서 성과를 냈다고 설명한다. 반대로 MiMo와 Claude는 대부분 슬라이드 없이 초기 그리드 의존형 전략을 썼고, GPT-5.5는 라운드당 약 120회 수준의 제한적 슬라이딩을 사용했다.

글은 이 결과를 단일 벤치마크로 과장하진 않지만, 오픈웨이트 모델이 프런티어 모델과의 격차를 빠르게 좁히고 있다는 신호로 해석한다.

이 요약은 원문 이해를 돕기 위한 큐레이션입니다. 저작권은 원저작자에게 있으며, 정확한 내용과 맥락은 원문을 확인하세요.

요약 오류, 출처 표기 문제, 삭제 요청은 문의 · 건의로 알려주세요.