GitHub 상태 페이지의 투명성을 더 높이다
핵심 내용
GitHub가 장애 분류와 uptime 산정, Copilot 모델 가용성 공지를 더 정밀하게 바꾼다.
자세히 보기
GitHub가 서비스 상태 페이지의 투명성을 높이기 위해 세 가지 변화를 도입한다. 장애 분류를 더 세분화하고, 각 서비스의 90일 uptime을 공개하며, Copilot의 모델 제공업체 장애를 별도 컴포넌트로 분리한다.
우선 새로운 심각도 단계인 Degraded Performance를 추가한다. 서비스는 동작하지만 지연, 기능 저하, 일부 요청의 간헐적 오류가 있는 상태를 뜻하며, 기존의 Partial Outage와 Major Outage와 함께 3단계 체계로 운영된다.
이 변경으로 경미한 문제까지 모두 부분 장애로 보이던 기존 분류의 한계를 줄인다. GitHub는 이전처럼 서비스가 일부만 불편한 상황도 실제 사용자 영향에 맞게 더 정확히 표시할 수 있다고 설명한다.
상태 페이지에는 각 서비스의 최근 90일 uptime percentage가 직접 표시된다. 산정 방식은 인시던트의 severity와 지속 시간을 반영하며, 업계 표준 status page 계산법을 따른다.
중요한 가중치는 다음과 같다.
- Major Outage: 전체 다운타임의 **100%**를 downtime으로 계산
- Partial Outage: **30%**만 downtime으로 반영
- Degraded Performance: **0%**로 처리, 서비스가 여전히 기능한다고 본다
예를 들어 90일 동안 1시간의 Partial Outage가 발생하면 uptime 계산에는 1시간 전체가 아니라 18분의 유효 downtime만 반영된다. 반면 Degraded Performance 인시던트는 uptime 수치에 영향을 주지 않는다.
Copilot 관련 공지도 더 정교해진다. 기존에는 모델 제공업체 장애가 발생하면 Copilot 전체 인시던트로 잡았지만, 앞으로는 Copilot AI Model Providers 컴포넌트로 분리해 어떤 모델이 영향을 받는지 더 명확히 전달한다.
이 변화는 Copilot Chat과 GitHub Copilot cloud agent(이전 coding agent)처럼 여러 모델을 지원하는 기능에서 특히 의미가 있다. 한 모델이 장애를 겪어도 다른 모델을 선택하거나 auto model selection을 활용할 수 있기 때문에, 실제 사용자 경험을 더 정확히 반영하려는 목적이다.
GitHub는 장애가 발생했을 때의 명확한 커뮤니케이션이 가장 중요하다고 강조한다. 이번 변경들은 운영팀이 의사결정을 더 잘 할 수 있도록 투명성, 정확성, 신속성을 높이기 위한 조치다.
이 한국어 요약은 AI가 자동으로 만들었습니다. 원문의 주장과 맥락은 원문에서 확인해 주세요. 저작권은 원저작자에게 있습니다.