Nvidia Nemotron 3 Ultra, Vercel AI Gateway에서 사용 가능
·2026.06.04 16:00
핵심 내용
Nvidia의 MoE 추론 모델 **Nemotron 3 Ultra**가 Vercel AI Gateway에 출시되어 에이전트 워크플로우 최적화를 지원한다.
자세히 보기
Nvidia의 Nemotron 3 Ultra가 Vercel AI Gateway에서 사용 가능해졌다. 이 모델은 계획, 도구 사용, 하위 에이전트 위임 및 오류 복구와 같은 복잡한 에이전트 워크플로우를 위해 설계된 오픈 Mixture-of-Experts(MoE) 추론 모델이다.
주요 성능 및 특징은 다음과 같다:
- 1M 토큰의 컨텍스트 창 지원
- 초당 최대 350 토큰의 처리량 달성
- 에이전트 작업 시 비용 최대 30% 절감
AI Gateway는 모델 호출을 위한 통합 API를 제공하며, 사용량 및 비용 추적, 재시도, 페일오버, 성능 최적화 기능을 통해 높은 가동 시간을 보장한다. 또한 별도의 플랫폼 수수료 없이 제공업체의 가격을 그대로 반영하며, Bring Your Own Key(BYOK) 요청 시에도 동일하게 적용된다.
이 한국어 요약은 AI가 자동으로 만들었습니다. 원문의 주장과 맥락은 원문에서 확인해 주세요. 저작권은 원저작자에게 있습니다.