NVIDIA와 AWS, 대규모 AI 프로덕션 구현을 위한 협력 강화
NVIDIA와 AWS가 협력하여 EC2 G7 인스턴스와 OpenSearch의 GPU 가속 기능을 통해 대규모 AI 워크로드 구현을 지원한다.
NVIDIA와 AWS는 기업들이 운영 복잡성을 최소화하면서 대규모 AI 시스템을 구축할 수 있도록 인프라 협력을 강화한다. 이번 협력은 저지연 추론, 빠른 벡터 검색, 강력한 GPU 성능을 제공하는 데 중점을 둔다.
새롭게 출시된 Amazon EC2 G7 인스턴스는 NVIDIA RTX PRO 4500 Blackwell Server Edition GPU를 탑재하여 AI 추론, 그래픽, 데이터 분석 워크로드를 지원한다. G6 인스턴스 대비 AI 추론 성능은 최대 4.6배, 그래픽 성능은 최대 2.1배 향상되었으며, NVIDIA cuDF 라이브러리를 통해 Apache Spark 기반 데이터 분석 속도를 대폭 높였다.
Amazon OpenSearch Serverless는 NVIDIA cuVS 라이브러리를 기본 컴퓨팅 옵션으로 채택하여 GPU 가속 벡터 인덱싱을 지원한다. 이를 통해 RAG(검색 증강 생성) 및 에이전트형 AI 구축 시, CPU 기반 대비 벡터 인덱싱 속도는 최대 10배 빨라지고 비용은 4분의 1 수준으로 절감된다.
또한, AWS는 NVIDIA GB300 기반의 학습 워크로드에서 NVIDIA Exemplar Cloud 인증을 획득했다. 이는 AWS가 NVIDIA의 참조 아키텍처에 부합하는 엄격한 성능 기준을 충족함을 의미하며, 고객은 대규모 AI 모델 학습 시 최적화된 고성능 인프라를 신뢰하고 사용할 수 있다.
이 요약은 원문 이해를 돕기 위한 큐레이션입니다. 저작권은 원저작자에게 있으며, 정확한 내용과 맥락은 원문을 확인하세요.
요약 오류, 출처 표기 문제, 삭제 요청은 문의 · 건의로 알려주세요.