AI Briefing

Gemma 4 26B NVFP4 공개

nvidia/Gemma-4-26B-A4B-NVFP4

·2026.05.01 12:37

NVIDIA가 Gemma 4 26B 모델의 NVFP4 양자화 체크포인트를 공개했다.

NVIDIA가 Gemma 4 26B A4B IT 기반의 NVFP4 양자화 체크포인트를 Hugging Face에 올렸다.

  • 기준 모델은 Google DeepMind의 Gemma 4 26B IT이며, 텍스트·이미지 입력을 지원한다.
  • 모델 카드는 256K 컨텍스트140개 이상 언어 지원을 강조한다.
  • 이번 버전은 NVIDIA Model Optimizer로 양자화됐고, vLLM 추론용으로 제공된다.
  • 문서상 모델 크기는 14B params, 총 파라미터는 25.2B, 활성 파라미터는 3.8B로 표기됐다.
  • 평가에서는 GPQA Diamond 79.9%, AIME 2025 90.0%, MMLU Pro 84.8%, LiveCodeBench 79.8% 등을 제시했다.
  • 다만 현재는 vLLM에서 TP=1만 지원하며, EP와 Flashinfer-TRTLLM 관련 제약과 미해결 이슈도 함께 적혀 있다.

이 요약은 원문 이해를 돕기 위한 큐레이션입니다. 저작권은 원저작자에게 있으며, 정확한 내용과 맥락은 원문을 확인하세요.

요약 오류, 출처 표기 문제, 삭제 요청은 문의 · 건의로 알려주세요.