AI Briefing
피드
안내
검색
EN
로그인
전체
피드·트렌딩·게시판 통합
피드
최신 뉴스
트렌딩
오픈소스·릴리즈
게시판
블로그·홍보
태그
주제별 탐색
#quantization
#quantization와 관련된 AI·개발 뉴스를 최신순으로 모았습니다. 원문 출처와 한국어 요약을 함께 확인할 수 있습니다.
피드
트렌딩
태그
설정
#quantization 4페이지 | AI Briefing
llama.cpp 동적 KV 캐시 양자화 기능
Reddit
·
2026.06.05 03시
DeepLearning.AI, vLLM 공식 강의 출시
Reddit
·
2026.06.05 02시
KVarN: Huawei가 개발한 vLLM 네이티브 KV-cache 양자화 백엔드
Hacker News
·
2026.06.05 00시
OCTOPUS: 최적 제곱 오차 양자화와 팔면체 매개변수화를 이용한 트랜스포머 KV Cache 최적화
Stability AI Research
·
2026.06.04 01시
Bonsai Image 4B: 초경량 Diffusion Transformer 공개
Reddit
·
2026.06.02 23시
Holo3.1: 로컬/모바일 에이전트 출시
HuggingFace Blog
·
2026.06.02 23시
llama.cpp 멀티 GPU KV 캐시 오류 수정
Reddit
·
2026.06.02 05시
로컬 디바이스를 위한 1-Bit Bonsai Image 4B 이미지 생성 모델
TLDR AI
·
2026.06.01 01시
MTP 헤드 통합 GGUF 출시
Reddit
·
1
·
2026.05.31 14시
추천
NVIDIA, Qwen3.6 NVFP4 공개
Reddit
·
2026.05.31 02시
vLLM, AMD용 HIP W4A16 커널 지원
Reddit
·
2026.05.29 21시
PrismML, 초경량 Bonsai Image 4B 출시
Reddit
·
2026.05.27 03시
KV 캐시 10배 압축하는 Shard 공개
Reddit
·
2026.05.26 13시
llama.cpp, CUDA용 FWHT로 추론 속도 개선
Reddit
·
2026.05.26 02시
2비트 KV 캐시 양자화 기술 'OSCAR' 공개
Reddit
·
2026.05.25 20시
MLX용 W8A8 양자화 SDK 'Cider' 공개
Reddit
·
2026.05.25 17시
Ascend NPU용 1.58비트 LLM 학습 시스템
Reddit
·
2026.05.25 00시
llama.cpp NVFP4/MTP 지원
Reddit
·
2026.05.24 03시
llama.cpp 비대칭 KV 캐시 양자화 이슈 및 최적화 논의
Reddit
·
3
·
2026.05.22 22시
Cohere, Apache 2.0 오픈 모델 'Command A+' 공개
Reddit
·
2026.05.22 13시
Mix-Quant: 프리필은 양자화, 디코딩은 고정밀 유지
Reddit
·
2026.05.22 04시
Tencent, 다국어 번역 모델 Hy-MT2 공개
Reddit
·
2026.05.21 21시
Cohere, Command A+ 공개
Reddit
·
2026.05.21 06시
Qwen 3.6 35B GGUF 공개
Reddit
·
2026.05.21 00시
이전
2
3
4
5
6
다음
이전
1
2
3
4
5
6
7
8
9
10
다음