CoreWeave, NVIDIA Vera Rubin NVL72와 Vera CPU 프로덕션 출시…첫 고객은 Cognition
핵심 내용
Cognition 벤치마크 결과 Vera Rubin NVL72가 GB200 NVL72 대비 SWE-2 추론 토큰 처리량을 최대 4.8배 높였다.
자세히 보기
CoreWeave가 클라우드에서 NVIDIA Vera Rubin NVL72 시스템과 Spectrum-X 102.4T Ethernet 네트워킹의 가용성을 발표하며 고객에게 이 플랫폼을 처음 공급했다. AI 소프트웨어 엔지니어 Devin을 개발한 응용 AI 연구소 Cognition이 새로운 인프라에서 프로덕션 워크로드를 실행하는 첫 고객이 됐다.
에이전틱 코딩 성능 향상
Cognition은 FrontierCode의 실제 소프트웨어 엔지니어링 작업을 사용해 GB200 NVL72를 기준으로 Vera Rubin의 추론 성능을 벤치마킹했다. 테스트 결과 Vera Rubin NVL72는 SWE-2 추론 워크로드에서 총 토큰 처리량을 최대 4.8배까지 높였다. 이러한 성능 향상으로 Devin의 실시간 코드 생성 속도가 빨라지고 다단계 추론 응답성이 개선됐다.
에이전트 샌드박스를 위한 NVIDIA Vera CPU
CoreWeave는 AI 에이전트를 위해 특별히 설계된 최초의 CPU인 NVIDIA Vera도 클라우드에서 제공한다고 밝혔다. Vera 랙 하나에는 128개 CPU와 11,264개 코어가 포함되어 11,000개 이상의 동시 격리 환경을 지원한다. 테스트에서 CoreWeave는 Vera CPU에서 에이전트 샌드박스 시작 시간을 3배 이상 단축했고, 모든 통과 작업에서 Terminal-Bench 성능을 1.7배 향상시켰다.
CoreWeave Forge로 AI 루프 통합
CoreWeave는 프로덕션과 훈련 간 격차를 줄이기 위해 Weights & Biases, OpenPipe의 후처리 전문성, marimo 노트북 프로젝트를 통합한 연결 환경 CoreWeave Forge를 출시했다. 주요 구성 요소는 다음과 같다:
- CoreWeave ARIA: 정식 출시되어 실행 분석, 실험 제안, 코드 변경 권고를 수행한다.
- CoreWeave Agent Lens: 실패 감지율을 20% 개선하고 절반 비용으로 문제를 해결하는 신규 서비스다.
- CoreWeave Sandboxes: 정식 출시되어 에이전트와 RL 실행을 위한 격리된 CPU 또는 GPU 실행 환경을 제공한다.
- Serverless RL: 자체 관리 설정보다 1.4배 빠른 속도로 40% 낮은 비용으로 훈련한다.
Forge의 초기 도입 기업에는 Canva, Capital One, MasterClass가 포함된다. 이 플랫폼은 추론 및 멀티모달 워크플로우 커스터마이징을 위해 NVIDIA Nemotron 오픈 모델을 지원한다.
이 한국어 요약은 AI가 자동으로 만들었습니다. 원문의 주장과 맥락은 원문에서 확인해 주세요. 저작권은 원저작자에게 있습니다.