AI Briefing

Nemotron Nano Omni 공개

Nemotron-3-Nano-Omni-30B-A3B-Reasoning, New model?

·2026.04.29 01:12

핵심 내용

NVIDIA가 멀티모달 Nemotron Nano Omni 30B A3B Reasoning을 공개했다.

자세히 보기

NVIDIA Nemotron 3 Nano Omni는 비디오·오디오·이미지·텍스트를 함께 처리하는 멀티모달 모델이다.

  • 출시일: 2026-04-28에 Build.Nvidia, Hugging Face(BF16/FP8/NVFP4), NGC로 공개됐다.
  • 구성: Mamba2-Transformer 하이브리드 MoE 구조이며, Nemotron 3 Nano LLM(30B A3B), CRADIO v4-H 비전 인코더, Parakeet 음성 인코더를 결합했다.
  • 스펙: 약 31B 파라미터, 최대 256k 토큰 컨텍스트를 지원하고, 비디오는 최대 2분, 오디오는 최대 1시간까지 받는다. 언어 지원은 영어만이다.
  • 기능: 텍스트 출력, JSON 포맷, reasoning 출력, tool calling, 단어 단위 타임스탬프 전사를 지원한다.

주요 활용처는 고객지원, 미디어·엔터테인먼트 분석, 문서 인텔리전스, GUI 자동화 등 기업용 워크로드다. 상용 사용이 가능하며 NVIDIA Open Model Agreement를 따른다.

배포 스택으로는 vLLM 0.20.0과 NeMo, Megatron, NeMo-RL, TensorRT-LLM, llama.cpp, Ollama, SGLang이 제시됐고, A100/H100/H200/B200/L40S/RTX 5090 등 NVIDIA GPU 호환성도 함께 안내됐다.

개선에는 Qwen3-VL-30B-A3B-Instruct, Qwen3.5-122B-A10B, Qwen3.5-397B-A17B, Qwen2.5-VL-72B-Instruct, gpt-oss-120b가 사용됐다.

이 한국어 요약은 AI가 자동으로 만들었습니다. 원문의 주장과 맥락은 원문에서 확인해 주세요. 저작권은 원저작자에게 있습니다.

AI 처리 방식을 확인하거나, 요약 오류와 출처 표기 문제, 삭제 요청을 문의 · 건의로 알려주세요.