GitHub, 에이전트 규모 개발 지원 위해 Git 인프라 재구축
핵심 내용
GitHub이 Git 인프라를 재구축해 쓰기 처리량을 최대 35배 높였다.
자세히 보기
GitHub은 에이전트 기반 소프트웨어 개발 급증에 대응하기 위해 Git 인프라를 재구축하고 있다. 에이전트와 개발자가 저장소에서 동시에 작업하는 흐름이 확산되면서, 2026년 8월 기준 월간 Git 활동량은 4733억 건으로 전년 대비 두 배 이상 증가했다. 9월 한 달간 개발자와 에이전트가 생성한 커밋은 73억 8000만 건으로, 1년 전의 5배를 넘어섰다.
아키텍처 병목 현상
현재 아키텍처는 Spokes를 통해 저장소 전체 사본을 로컬 디스크에 보관하는 방식을 사용하지만, 대규모 환경에서는 치명적인 한계에 직면한다. 내구성(Durability)과 확장성(Scale)이 결합되어 있어 읽기 복제본을 추가하면 쓰기 성능이 저하된다. 모든 푸시는 복제본의 다수결(Quorum) 확인을 받아야 하기 때문이다. 주요 과제는 다음과 같다:
- 커밋 처리 지연: 푸시 지연에 묶인 에이전트가 병목 현상을 유발한다.
- 쓰기 처리량: 푸시량이 전년 대비 4.9배 증가하며 아키텍처의 단일 지점에 집중된다.
- 병합 경쟁: 트렁크 기반 개발 방식이 작업을 단일 참조로 집중시킨다.
- 읽기 팬아웃: CI와 코드 스캐닝으로 인해 푸시 한 번이 수천 건의 읽기 요청으로 확산된다. 9월에는 GitHub Actions가 32억 6000만 회 실행되었다.
새로운 설계 원칙
새로운 아키텍처는 내구성과 확장성을 분리하여 읽기와 쓰기를 독립적으로 확장할 수 있도록 한다. 권위 있는 저장소 데이터는 Azure Blob Storage로 이동하고, 경량 컴퓨트 워커가 요청 처리와 캐싱을 담당한다. 이 설계는 합의(Consensus)를 참조 업데이트로 제한해 조정을 최소화하며, 객체 저장과 검증 작업을 병렬로 수행한다. 컴팩션과 가비지 컬렉션 같은 유지보수 작업은 서비스 경로에서 백그라운드 워커로 분리된다.
성능 및 영향
내부 벤치마크 결과, 새로운 시스템은 최대 35배 높은 쓰기 처리량을 제공하며 읽기 용량은 수요에 따라 독립적으로 확장된다. 이번 재구축은 브랜치 보호 및 감사 로그 같은 기존 통제 기능을 유지하면서, 단일 코드베이스에서 수천 개의 에이전트를 운영하는 엔터프라이즈 팀 등 가장 까다로운 워크로드를 지원한다. 이 기반은 대규모 기업부터 개인 오픈소스 유지보수자까지 모든 사용자에게 더 빠르고 탄력적인 플랫폼을 제공하는 것을 목표로 한다.
이 한국어 요약은 AI가 자동으로 만들었습니다. 원문의 주장과 맥락은 원문에서 확인해 주세요. 저작권은 원저작자에게 있습니다.