AI Briefing

Gemma 4 26B NVFP4 공개

nvidia/Gemma-4-26B-A4B-NVFP4

·2026.05.01 12:37

핵심 내용

NVIDIA가 Gemma 4 26B 모델의 NVFP4 양자화 체크포인트를 공개했다.

자세히 보기

NVIDIA가 Gemma 4 26B A4B IT 기반의 NVFP4 양자화 체크포인트를 Hugging Face에 올렸다.

  • 기준 모델은 Google DeepMind의 Gemma 4 26B IT이며, 텍스트·이미지 입력을 지원한다.
  • 모델 카드는 256K 컨텍스트와 140개 이상 언어 지원을 강조한다.
  • 이번 버전은 NVIDIA Model Optimizer로 양자화됐고, vLLM 추론용으로 제공된다.
  • 문서상 모델 크기는 14B params, 총 파라미터는 25.2B, 활성 파라미터는 3.8B로 표기됐다.
  • 평가에서는 GPQA Diamond 79.9%, AIME 2025 90.0%, MMLU Pro 84.8%, LiveCodeBench 79.8% 등을 제시했다.
  • 다만 현재는 vLLM에서 TP=1만 지원하며, EP와 Flashinfer-TRTLLM 관련 제약과 미해결 이슈도 함께 적혀 있다.

이 한국어 요약은 AI가 자동으로 만들었습니다. 원문의 주장과 맥락은 원문에서 확인해 주세요. 저작권은 원저작자에게 있습니다.

AI 처리 방식을 확인하거나, 요약 오류와 출처 표기 문제, 삭제 요청을 문의 · 건의로 알려주세요.