Nvidia Nemotron 3 Ultra, Vercel AI Gateway에서 사용 가능
·2026.06.04 16:00
Nvidia의 MoE 추론 모델 **Nemotron 3 Ultra**가 Vercel AI Gateway에 출시되어 에이전트 워크플로우 최적화를 지원한다.
Nvidia의 Nemotron 3 Ultra가 Vercel AI Gateway에서 사용 가능해졌다. 이 모델은 계획, 도구 사용, 하위 에이전트 위임 및 오류 복구와 같은 복잡한 에이전트 워크플로우를 위해 설계된 오픈 Mixture-of-Experts(MoE) 추론 모델이다.
주요 성능 및 특징은 다음과 같다:
- 1M 토큰의 컨텍스트 창 지원
- 초당 최대 350 토큰의 처리량 달성
- 에이전트 작업 시 비용 최대 30% 절감
AI Gateway는 모델 호출을 위한 통합 API를 제공하며, 사용량 및 비용 추적, 재시도, 페일오버, 성능 최적화 기능을 통해 높은 가동 시간을 보장한다. 또한 별도의 플랫폼 수수료 없이 제공업체의 가격을 그대로 반영하며, Bring Your Own Key(BYOK) 요청 시에도 동일하게 적용된다.
이 요약은 원문 이해를 돕기 위한 큐레이션입니다. 저작권은 원저작자에게 있으며, 정확한 내용과 맥락은 원문을 확인하세요.
요약 오류, 출처 표기 문제, 삭제 요청은 문의 · 건의로 알려주세요.