AI Briefing

Groq 3 LPX 양산 돌입, NVIDIA가 Vera Rubin 에이전트 추론 확장

·2026.08.25 00:00

핵심 내용

NVIDIA가 Groq 3 LPX 양산을 시작하며 Vera Rubin 기반 에이전트 추론 성능을 대폭 강화했다.

자세히 보기

NVIDIA는 Groq 3 LPX의 양산을 공식 발표하며, Vera Rubin NVL72 플랫폼을 통해 에이전트 시스템의 빠른 토큰 생성을 지원하고 있다. Artificial Analysis 벤치마크에서 오픈소스 에이전트 모델 Gemma 4 31B를 구동할 때, 10만 토큰의 긴 컨텍스트 환경에서 초당 3,400개의 출력 토큰을 생성해 경쟁 플랫폼 대비 4배 빠른 성능을 입증했다.

NVIDIA는 '극단적 코드SIGN(Extreme Codesign)'을 통해 컴퓨트, 네트워킹, 추론 가속을 통합된 시스템으로 설계하여 AI 팩토리의 효율성을 극대화하고 있다. Spectrum-X Ethernet은 대용량 데이터 흐름을 효율적으로 처리하고, Groq 3 LPX는 초저지연 추론 아키텍처로 에이전트 워크로드에 최적화된 토큰 생성 속도를 제공한다.

주요 파트너사들은 이미 Vera Rubin 플랫폼을 도입하고 있다.

  • Nebius: Groq 3 LPX를 채택한 첫 AI 클라우드 서비스 제공업체로, 개발자에게 초고속 토큰 생성 환경을 제공한다.
  • CoreWeave: Vera Rubin 랙을 연결하는 Spectrum-X Multiplane을 프로덕션 환경에 배포하여 고대역폭 AI 네트워크를 구축했다.
  • SpaceXAI: 차세대 에이전트 AI 인프라에 NVIDIA Vera CPU를 적용하여 오케스트레이션 및 시뮬레이션 등 CPU 집약적 작업을 가속할 계획이다.

이 한국어 요약은 AI가 자동으로 만들었습니다. 원문의 주장과 맥락은 원문에서 확인해 주세요. 저작권은 원저작자에게 있습니다.

AI 처리 방식을 확인하거나, 요약 오류와 출처 표기 문제, 삭제 요청을 문의 · 건의로 알려주세요.