AI Briefing
피드
안내
검색
EN
로그인
전체
피드·트렌딩·게시판 통합
피드
최신 뉴스
트렌딩
오픈소스·릴리즈
게시판
블로그·홍보
태그
주제별 탐색
#nvfp4
#nvfp4와 관련된 AI·개발 뉴스를 최신순으로 모았습니다. 원문 출처와 한국어 요약을 함께 확인할 수 있습니다.
피드
트렌딩
태그
설정
Amazon EKS에서 vLLM으로 Gemma 4 서빙 최적화하기 [2부: GPU 한 장의 처리량과 지연 SLO]
AWS Tech Blog (한국)
·
2026.09.10 09시
NInfer 포크 공개: RTX 5090에서 NVFP4 KV 캐시 및 YARN으로 555k 컨텍스트 지원
Reddit
·
2026.09.06 07시
NVIDIA, DeepSeek-V4-Pro-0813의 NVFP4 양자화 모델 공개
TLDR AI
·
2026.08.31 09시
Qwen3.8-27B NVFP4 양자화 공개
Reddit
·
2026.08.26 10시
NVFP4 증류, 내부 기하 보존
Reddit
·
2026.08.10 05시
Laguna-S 2.1 체크포인트 공개
Reddit
·
2026.08.03 05시
Laguna S 2.1 가중치 업데이트
Reddit
·
2026.08.01 22시
Unsloth, Qwen3.6 NVFP4 양자화 출시
Reddit
·
1
·
2026.07.13 19시
Blackwell 기반 GLM-5.2 최적 배포 가이드
Reddit
·
2026.07.08 04시
추천
NVIDIA, Qwen3.6 NVFP4 공개
Reddit
·
2026.05.31 02시
llama.cpp NVFP4/MTP 지원
Reddit
·
2026.05.24 03시
실시간 장편 영상 생성 GitHub 저장소
TLDR AI
·
2026.05.20 09시
NVIDIA Kimi NVFP4 공개
Reddit
·
1
·
2026.05.14 21시
Mac Mini M4 Pro 70 t/s
Reddit
·
2026.05.03 14시
Gemma 4 26B NVFP4 공개
Reddit
·
2026.05.01 12시
llama.cpp NVFP4 비교
Reddit
·
2026.04.29 21시
llama.cpp Blackwell NVFP4 지원
Reddit
·
2026.04.29 17시
llama.cpp, SM120 NVFP4 MMQ 병합
Reddit
·
2026.04.29 09시
GLM 5.1 로컬 40tps
Reddit
·
2026.04.26 01시
llama.cpp·ik_llama.cpp FP4 지원
Reddit
·
1
·
2026.04.26 00시
Qwen3.6-27B 80 tps
Reddit
·
2026.04.25 19시
#nvfp4 | AI Briefing