AI Briefing

Kimi K2.6: 오픈소스 코딩의 진화

·2026.04.21 00:28

Kimi K2.6가 코딩·장기 실행·에이전트 스웜 성능을 공개했다.

Moonshot AI가 Kimi K2.6을 오픈소스로 공개했다. 핵심 포인트는 state-of-the-art coding, long-horizon execution, agent swarm capabilities다. 모델은 Kimi.com, Kimi App, API, Kimi Code에서 사용할 수 있다.

성능 소개에서는 일반 에이전트, 코딩, 비주얼 에이전트 전반의 벤치마크 향상을 강조한다.

  • General Agents: Humanity's Last Exam (Full) w/ tools, BrowseComp, DeepSearchQA, Toolathlon, OSWorld-Verified
  • Coding: Terminal-Bench 2.0, SWE-Bench Pro, SWE-Multilingual
  • Visual Agents: MathVision w/ python, V w/ python*

장기 코딩 사례도 제시했다.

  • Mac에서 Qwen3.5-0.8B를 로컬 배포하고, Zig로 추론을 최적화해 4,000+ tool calls, 12시간+, 14 iterations를 수행했다.
  • 처리량은 약 15 tok/s에서 193 tok/s로 개선됐고, 최종적으로 LM Studio보다 약 20% 빠른 속도를 냈다고 밝혔다.
  • 8년 된 오픈소스 금융 매칭 엔진 exchange-core13시간 동안 재구성해, 1,000+ tool calls4,000+ lines 수정, 12개 최적화 전략을 적용했다.
  • 그 결과 medium throughput 185% 증가(0.43 → 1.24 MT/s), performance throughput 133% 증가(1.23 → 2.86 MT/s)를 주장했다.

또한 내부 벤치마크인 Kimi Code BenchKimi Design Bench를 통해, 프런트엔드 생성, 애니메이션, 풀스택 워크플로, 이미지·비디오 생성 도구 활용까지 아우르는 능력을 소개했다. 디자인 생성 예시에서는 단일 프롬프트로 미려한 랜딩 페이지, 인증과 DB를 포함한 간단한 풀스택 앱, 도구 연동형 웹사이트 제작을 보여준다.

마지막으로 Agent Swarm 기능을 강조한다. 단일 모델을 키우는 방식이 아니라, 작업을 여러 전문 에이전트로 분해해 병렬 실행하는 구조이며, K2.6에서는 K2.5 대비 더 높은 수준의 스웜 경험을 제공한다고 설명한다.

이 요약은 원문 이해를 돕기 위한 큐레이션입니다. 저작권은 원저작자에게 있으며, 정확한 내용과 맥락은 원문을 확인하세요.

요약 오류, 출처 표기 문제, 삭제 요청은 문의 · 건의로 알려주세요.