AI Briefing

Armature, 17k 에이전트 실행 데이터 공개

Which tools does Claude Code choose and how does it compare to other agents? We measured 17k runs to find out

·2026.09.12 01:45

핵심 내용

17,000회 에이전트 실행 분석 결과, Claude Code는 웹 검색을 거의 하지 않으며 코딩 에이전트 간 도구 선택 불일치가 빈번한 것으로 나타났다.

자세히 보기

Armature가 실제 환경과 유사한 조건에서 17,000회의 에이전트 세션을 측정하여 코딩 에이전트의 도구 선택 패턴을 분석한 데이터를 공개했다. 이번 분석은 다양한 저장소와 페르소나(바이브 코더, 주니어/시니어 엔지니어)를 대상으로 진행됐다.

주요 발견 사항

  • 웹 검색 빈도 차이: Claude Code는 웹 검색을 거의 수행하지 않는 반면, Codex는 빈번하게 사용하며 Cursor는 중간 정도의 빈도를 보였다.
  • 도구 선택 불일치: 코딩 에이전트들이 서로 동의하는 경우보다 불일치하는 경우가 더 많았다.
  • 언급과 선택의 괴리: LangChain, Supabase, Netlify, PayPal, Adyen 등 특정 카테고리의 주요 플레이어들은 자주 언급되지만 실제로 선택되지는 않는 경향이 있었다.
  • 컨텍스트 영향력: 저장소 컨텍스트를 수정하면 에이전트의 도구 선택 결과가 완전히 달라질 수 있다.

모든 실행 트레이스는 Armature 블로그를 통해 공개되어 있으며, 개발자들은 이를 통해 에이전트의 도구 선택 로직을 더 깊이 이해할 수 있다.

이 한국어 요약은 AI가 자동으로 만들었습니다. 원문의 주장과 맥락은 원문에서 확인해 주세요. 저작권은 원저작자에게 있습니다.

AI 처리 방식을 확인하거나, 요약 오류와 출처 표기 문제, 삭제 요청을 문의 · 건의로 알려주세요.