AI Briefing

llama.cpp, SM120 NVFP4 MMQ 병합

llama.cpp's Preliminary SM120 Native NVFP4 MMQ Is Merged

·2026.04.29 09:39

llama.cpp에 초기 SM120용 네이티브 NVFP4 MMQ 지원이 병합되고 관련 GGUF 변환본도 공개됐다.

llama.cpp의 CUDA 백엔드에 SM120용 네이티브 NVFP4 MMQ 경로가 병합됐다. 해당 PR은 23개 커밋으로 묶여 4월 28일 병합됐다.

변경은 Blackwell용 NVFP4 커널 추가, FP4 양자화 경로 통합, FP4 MMA 템플릿 정리로 요약된다.

관련 GGUF 변환본도 바로 공유됐다.

  • Gemma 4 31B ITNVFP4 GGUF
  • Nemotron Cascade 2 30B A3BNVFP4 GGUF
  • Qwen3.5 35B A3BNVFP4 GGUF

이 요약은 원문 이해를 돕기 위한 큐레이션입니다. 저작권은 원저작자에게 있으며, 정확한 내용과 맥락은 원문을 확인하세요.

요약 오류, 출처 표기 문제, 삭제 요청은 문의 · 건의로 알려주세요.