AI Briefing

8억 명의 ChatGPT 사용자를 지원하기 위한 PostgreSQL 확장 전략

·2026.01.22 21:00

OpenAI는 단일 프라이머리와 다수의 읽기 복제본을 활용해 8억 명의 ChatGPT 사용자를 지원하는 PostgreSQL 확장 전략을 공개했다.

PostgreSQL은 ChatGPT와 OpenAI API를 뒷받침하는 핵심 데이터 시스템이다. 최근 1년 사이 데이터베이스 부하가 10배 이상 급증했음에도 불구하고, OpenAI는 단일 Azure PostgreSQL flexible server 프라이머리와 전 세계 여러 지역에 분산된 약 **50개의 읽기 복제본(read replicas)**을 통해 수백만 QPS를 처리하고 있다.

하지만 단일 프라이머리 구조는 쓰기 부하가 급증할 때 취약점을 보인다. 특히 PostgreSQL의 MVCC(다중 버전 동시성 제어) 방식은 쓰기 작업 시 전체 행을 복사해야 하므로 **쓰기 증폭(write amplification)**과 **읽기 증폭(read amplification)**을 유발하며, 테이블 및 인덱스 비대화(bloat)와 복잡한 autovacuum 튜닝 문제를 야기한다.

이러한 한계를 극복하기 위해 OpenAI는 다음과 같은 전략을 취하고 있다:

  • Azure Cosmos DB와 같은 샤딩 가능한 시스템으로 쓰기 집약적인 워크로드를 이전
  • 애플리케이션 로직 최적화를 통해 불필요한 쓰기 최소화
  • 신규 워크로드는 기본적으로 샤딩된 시스템을 사용하도록 설정

현재 PostgreSQL은 샤딩하지 않은 상태를 유지하고 있다. 기존 워크로드를 샤딩하는 것은 매우 복잡하고 시간이 많이 걸리는 작업이기 때문이다. 대신 읽기 중심의 워크로드에 최적화된 현재 구조를 유지하며 향후 성장을 위한 충분한 여유 공간을 확보하는 데 집중하고 있다.

이 요약은 원문 이해를 돕기 위한 큐레이션입니다. 저작권은 원저작자에게 있으며, 정확한 내용과 맥락은 원문을 확인하세요.

요약 오류, 출처 표기 문제, 삭제 요청은 문의 · 건의로 알려주세요.