AI Briefing

NVIDIA와 Google Cloud, 에이전트 AI와 피지컬 AI 발전 협력

·2026.04.22 21:00

핵심 내용

Google Cloud와 NVIDIA가 AI Hypercomputer를 확장해 에이전트·피지컬 AI를 키운다.

자세히 보기

NVIDIA와 Google Cloud는 10년 넘게 협력해 온 풀스택 AI 플랫폼을 기반으로, 에이전트 AI와 피지컬 AI를 본격적으로 프로덕션 단계로 끌어올리고 있다. Google Cloud Next에서는 이 협력이 한 단계 더 확장되며, Google Cloud AI Hypercomputer를 AI factory용 인프라로 강화하는 여러 발표가 나왔다.

핵심은 차세대 인프라와 보안, 오픈 모델, 산업용 AI를 하나의 스택으로 묶는 것이다. 새로 공개된 내용에는 NVIDIA Vera Rubin 기반 A5X bare-metal instances, Google Distributed Cloud에서의 Gemini 프리뷰, Blackwell 및 Blackwell Ultra GPU를 활용한 구성이 포함된다.

인프라 측면에서는 A5X가 Vera Rubin NVL72 rack-scale 시스템을 기반으로 하며, 이전 세대 대비 토큰당 추론 비용 10배 절감, 메가와트당 토큰 처리량 10배 향상을 목표로 한다. 또한 ConnectX-9 SuperNICs와 차세대 Google Virgo networking을 통해 단일 사이트 클러스터에서 최대 80,000개 NVIDIA Rubin GPU, 멀티사이트 클러스터에서 최대 960,000개 GPU까지 확장하도록 설계됐다.

Google Cloud의 NVIDIA Blackwell 포트폴리오는 다음처럼 넓게 구성된다.

  • A4 VMs with HGX B200 systems
  • A4X VMs with GB200 NVL72
  • A4X Max with GB300 NVL72
  • fractional G4 VMs with RTX PRO 6000 Blackwell Server Edition GPUs

이 구조를 통해 고객은 여러 NVL72 랙을 연결해 수만 개 GPU로 확장하거나, 단일 랙에서 최대 72개의 Blackwell GPU를 활용하거나, 심지어 1/8 GPU 단위로도 자원을 맞춰 쓸 수 있다. 이렇게 확보한 유연성은 mixture-of-experts reasoning, multimodal inference, data processing, 복잡한 시뮬레이션까지 폭넓게 지원한다.

보안과 주권형 AI도 강화된다. Google Gemini 모델은 Google Distributed Cloud에서 Blackwell 및 Blackwell Ultra GPU 위에서 프리뷰로 제공되며, NVIDIA Confidential Computing은 프롬프트와 fine-tuning 데이터를 암호화된 상태로 유지해 인프라 운영자도 열람하거나 변경할 수 없게 한다. 퍼블릭 클라우드에서는 Confidential G4 VMs with RTX PRO 6000 Blackwell GPUs 프리뷰가 멀티테넌트 환경에 이 보호 기능을 확장한다.

모델과 에이전트 개발 측면에서는 Gemini, Gemma, NVIDIA Nemotron 오픈 모델, 더 넓은 오픈 웨이트 생태계를 모두 지원한다. 특히 NVIDIA Nemotron 3 Super가 Gemini Enterprise Agent Platform에서 제공되며, Managed Training Clusters에는 NVIDIA NeMo RL 기반의 새 managed reinforcement learning API가 들어가 클러스터 사이징, 장애 복구, 작업 실행을 자동화한다.

실사용 사례도 이미 나오고 있다.

  • Thinking Machines Lab은 A4X Max VMs와 GB300 NVL72로 Tinker API 학습을 가속한다.
  • OpenAI는 GB300과 GB200 NVL72 시스템을 Google Cloud에서 대규모 추론에 사용하며, ChatGPT를 포함한 고부하 워크로드를 돌리고 있다.
  • CrowdStrike는 NeMo Data Designer, NeMo Automodel, NeMo Megatron Bridge로 합성 데이터를 만들고 도메인 특화 사이버보안 모델을 튜닝한다.

산업 및 피지컬 AI에서는 NVIDIA Omniverse 라이브러리와 오픈소스 NVIDIA Isaac Sim이 Google Cloud Marketplace에서 제공되며, 정밀한 digital twin과 로보틱스 시뮬레이션 파이프라인을 구축할 수 있다. 여기에 NVIDIA NIM microservices, 예를 들어 Cosmos Reason 2를 Vertex AI와 Google Kubernetes Engine에 배포해 로봇과 vision AI agent가 현실 세계에서 보고, 추론하고, 행동하도록 만든다.

이 플랫폼은 결국 코드 리뷰, 보안, 팩토리 최적화, 약물 발견, 생성형 이미지, 비디오 인텔리전스까지 다양한 분야에서 실험을 생산 시스템으로 전환하는 기반이 된다. Snap, Schrödinger, Salesforce 같은 기업과 CodeRabbit, Factory, Aible, Mantis AI, Photoroom, Baseten 등 스타트업이 이미 이 조합을 활용하고 있으며, 공동 개발자 커뮤니티는 1년 남짓한 기간에 90,000명 이상으로 성장했다.

이 한국어 요약은 AI가 자동으로 만들었습니다. 원문의 주장과 맥락은 원문에서 확인해 주세요. 저작권은 원저작자에게 있습니다.

AI 처리 방식을 확인하거나, 요약 오류와 출처 표기 문제, 삭제 요청을 문의 · 건의로 알려주세요.