[기술이 장르가 되는 곳, kt cloud] 케클러 인터뷰 시리즈 #2: 장애에도 서비스가 멈추지 않는 'Multi-AZ' 엔지니어링 비하인드
·2026.05.27 10:35
kt cloud는 장애 발생 시에도 서비스 연속성을 보장하기 위해 Multi-AZ 아키텍처를 설계하고 구현한다.
기존의 DR(재해 복구) 구조는 장애 발생 시 다른 리전으로 서비스를 전환하는 방식이었으나, 운영 부담과 비효율성이라는 한계가 있었다. 고객이 직접 복구 순서를 결정해야 하는 운영 복잡성과, 평상시 사용하지 않는 Active-Standby 시스템에 발생하는 비용 문제가 주요 원인이었다.
kt cloud는 "장애 이후의 복구"가 아닌 "장애를 전제로 한 설계"로 관점을 전환했다. 이를 위해 하나의 리전 내 여러 가용 영역에 서비스를 분산 운영하는 Multi-AZ(Multiple Availability Zones) 아키텍처를 도입했다.
Multi-AZ 구조를 통해 특정 데이터센터에 장애가 발생하더라도 서비스 연속성을 유지할 수 있으며, 고객의 복구 운영 부담을 획기적으로 줄이는 것을 목표로 한다.
이 요약은 원문 이해를 돕기 위한 큐레이션입니다. 저작권은 원저작자에게 있으며, 정확한 내용과 맥락은 원문을 확인하세요.
요약 오류, 출처 표기 문제, 삭제 요청은 문의 · 건의로 알려주세요.