AI Briefing
추천

NVIDIA, RTEB 1위 Nemotron 3 Embed 공개

NVIDIA, RTEB 1위 오픈 임베딩 모델 Nemotron 3 Embed 공개 (feat. RAG, 에이전트 검색)

·2026.07.20 08:30

핵심 내용

NVIDIA가 검색 성능을 극대화한 오픈 임베딩 모델 컬렉션 Nemotron 3 Embed를 공개했다.

1 / 2

자세히 보기

NVIDIA가 RAG(검색 증강 생성) 및 에이전트 워크플로우의 검색 품질을 높이기 위한 Nemotron 3 Embed 컬렉션을 출시했습니다. 이 모델은 정확도와 효율성 사이의 스펙트럼을 고려하여 세 가지 버전으로 제공됩니다.

주요 모델 라인업:

  • 8B 모델: RTEB(Retrieval Embedding Benchmark) 다국어 리더보드 1위를 기록한 플래그십 모델로, 고신뢰 엔터프라이즈 RAG에 최적화되었습니다.
  • 1B 모델: 지연 시간과 비용 효율성을 극대화하여 대규모 프로덕션 서빙에 적합합니다.
  • 1B NVFP4 모델: NVIDIA Blackwell 아키텍처에 최적화되어 초고처리량을 지원합니다.

모든 모델은 32k 토큰의 긴 컨텍스트를 지원하며, 동적 임베딩 크기(dynamic embedding size) 기능을 통해 벡터 차원을 조절하여 저장 공간과 검색 비용을 최적화할 수 있습니다. 한국어를 포함한 34개 언어와 코드 검색을 지원하며, 가중치와 학습 레시피가 모두 공개되어 있어 미세조정(fine-tuning)이 가능합니다.

이 한국어 요약은 AI가 자동으로 만들었습니다. 원문의 주장과 맥락은 원문에서 확인해 주세요. 저작권은 원저작자에게 있습니다.

AI 처리 방식을 확인하거나, 요약 오류와 출처 표기 문제, 삭제 요청을 문의 · 건의로 알려주세요.