AI Briefing

Gemini Robotics ER 2 공개

·2026.07.31 00:00

구글이 로봇의 고차원 추론과 실시간 작업을 지원하는 'Gemini Robotics ER 2'를 공개했다.

구글은 로봇이 물리적 세계를 이해하고 다단계 작업을 계획할 수 있도록 돕는 고차원 '체화된 추론(Embodied Reasoning)' 모델인 Gemini Robotics ER 2를 출시했다. 이 모델은 로봇의 '두뇌' 역할을 하며, 인간과 대화하고 물리적 환경을 이해하는 동시에 하위 수준의 VLA(Vision-Language-Action) 모델에 실행 명령을 전달한다.

Gemini Robotics ER 2는 이전 버전인 ER 1.6 대비 대폭 향상된 성능을 제공한다. 주요 특징은 다음과 같다:

  • 실시간 추론 및 실행: Gemini Live API를 통해 지연 시간을 최소화하여, 로봇이 동작을 수행하는 동시에 다음 단계를 생각할 수 있는 유연한 오케스트레이션을 구현했다.
  • 자기 수정 및 적응: 연속적인 비디오 피드를 통해 자신의 진행 상황을 추적하고, 오류 발생 시 스스로 수정하며 다음 단계로 넘어갈 시점을 정확히 파악한다.
  • 도구 활용 및 협업: Google Search와 같은 외부 도구를 호출하거나, 여러 로봇이 협업하여 복잡한 워크플로우를 완수하는 다중 로봇 협업(Multi-robot collaboration) 기능을 지원한다.

현재 이 모델은 Gemini API, Google AI Studio, 그리고 Gemini Enterprise Agent Platform을 통해 개발자들에게 공개되었으며, 보스턴 다이내믹스의 Spot과 결합하여 자연어 명령만으로 물건을 가져오는 데모를 선보였다.

이 요약은 원문 이해를 돕기 위한 큐레이션입니다. 저작권은 원저작자에게 있으며, 정확한 내용과 맥락은 원문을 확인하세요.

요약 오류, 출처 표기 문제, 삭제 요청은 문의 · 건의로 알려주세요.