Gemma 4 26B NVFP4 공개
nvidia/Gemma-4-26B-A4B-NVFP4
·2026.05.01 12:37
핵심 내용
NVIDIA가 Gemma 4 26B 모델의 NVFP4 양자화 체크포인트를 공개했다.
자세히 보기
NVIDIA가 Gemma 4 26B A4B IT 기반의 NVFP4 양자화 체크포인트를 Hugging Face에 올렸다.
- 기준 모델은 Google DeepMind의 Gemma 4 26B IT이며, 텍스트·이미지 입력을 지원한다.
- 모델 카드는 256K 컨텍스트와 140개 이상 언어 지원을 강조한다.
- 이번 버전은 NVIDIA Model Optimizer로 양자화됐고, vLLM 추론용으로 제공된다.
- 문서상 모델 크기는 14B params, 총 파라미터는 25.2B, 활성 파라미터는 3.8B로 표기됐다.
- 평가에서는 GPQA Diamond 79.9%, AIME 2025 90.0%, MMLU Pro 84.8%, LiveCodeBench 79.8% 등을 제시했다.
- 다만 현재는 vLLM에서 TP=1만 지원하며, EP와 Flashinfer-TRTLLM 관련 제약과 미해결 이슈도 함께 적혀 있다.
이 한국어 요약은 AI가 자동으로 만들었습니다. 원문의 주장과 맥락은 원문에서 확인해 주세요. 저작권은 원저작자에게 있습니다.