llama.cpp, SM120 NVFP4 MMQ 병합
llama.cpp's Preliminary SM120 Native NVFP4 MMQ Is Merged
·2026.04.29 09:39
핵심 내용
llama.cpp에 초기 SM120용 네이티브 NVFP4 MMQ 지원이 병합되고 관련 GGUF 변환본도 공개됐다.
자세히 보기
llama.cpp의 CUDA 백엔드에 SM120용 네이티브 NVFP4 MMQ 경로가 병합됐다. 해당 PR은 23개 커밋으로 묶여 4월 28일 병합됐다.
변경은 Blackwell용 NVFP4 커널 추가, FP4 양자화 경로 통합, FP4 MMA 템플릿 정리로 요약된다.
관련 GGUF 변환본도 바로 공유됐다.
Gemma 4 31B IT용NVFP4 GGUFNemotron Cascade 2 30B A3B용NVFP4 GGUFQwen3.5 35B A3B용NVFP4 GGUF
이 한국어 요약은 AI가 자동으로 만들었습니다. 원문의 주장과 맥락은 원문에서 확인해 주세요. 저작권은 원저작자에게 있습니다.