AI Briefing
피드
안내
개발
검색
로그인
전체
피드·트렌딩·게시판 통합
피드
최신 뉴스
주간
주간·월간 인기
트렌딩
오픈소스·릴리즈
게시판
블로그·홍보
태그
주제별 탐색
#quantization
피드
트렌딩
주간
태그
설정
LittleBit-2: 잠재 기하 정렬로 1비트 미만 LLM의 스펙트럼 에너지 이득 극대화
Samsung Research
·
2026.08.04 08시
더 작고 빠르고 안전하게: Kimi와 GLM을 대규모로 실행하기
Cloudflare Blog
·
2026.08.03 22시
MSLK 커널 레퍼런스(웹사이트)
TLDR AI
·
2026.08.03 09시
NanoQuant: 대규모 언어 모델의 효율적인 1비트 미만 양자화
Samsung Research
·
2026.08.03 08시
EdgeRazor, 1.88비트 LLM
Reddit
·
2026.08.03 04시
Escha-W2 (Hugging Face 저장소)
TLDR AI
·
2026.07.30 09시
BeeLlama.cpp v0.4.1 출시: KV 캐시 양자화 성능 개선
Reddit
·
2026.07.27 01시
추천
POCKET-Image: 온디바이스 한글 렌더링 해결
PyTorchKR 읽을거리
·
2
·
2026.07.26 17시
LLM의 통계적 무손실 양자화 기술 SLQ 공개
Reddit
·
2026.07.25 03시
audio.cpp 0.4, TTS 35개 모델 패밀리 지원
Reddit
·
2026.07.24 09시
Diffusers, Nunchaku 4비트 양자화 공식 지원
HuggingFace Blog
·
2026.07.23 09시
BTL-3 27B 에이전트 모델 공개
Reddit
·
2026.07.23 04시
llama.cpp, AMD ROCm 성능 향상 및 버그 수정
Reddit
·
2026.07.21 15시
Qwen2.5-Coder 양자화 성능 연구 결과
Reddit
·
2026.07.20 16시
BeeLlama.cpp v0.4.0 출시
Reddit
·
2026.07.20 03시
재구성 오차와 다운스트림 성능의 불일치 연구
Reddit
·
2026.07.20 00시
llama.cpp, Bonsai 모델 추론 성능 개선
Reddit
·
2026.07.16 13시
Bonsai 27B: 1비트/삼진 양자화로 온디바이스 실행
PyTorchKR 읽을거리
·
2026.07.16 12시
colibri: 소비자용 PC에서 744B MoE 실행
PyTorchKR 읽을거리
·
2026.07.14 15시
Unsloth, Qwen3.6 NVFP4 양자화 출시
Reddit
·
1
·
2026.07.13 19시
ggml, Ternary Bonsai 지원 위한 Q2_0 양자화 추가
Reddit
·
2026.07.08 23시
Sana 1.6B 모델, 1.58비트 양자화 공개
Reddit
·
2026.06.28 14시
EdgeRazor: 1.58-bit 양자화 지원 경량 LLM 프레임워크
Reddit
·
2026.06.25 01시
OSCAR: 2-bit KV Cache 양자화 기술 공개
Reddit
·
2026.06.10 04시
이전
1
2
더 많은 페이지
6
다음
이전
1
2
3
4
5
6
다음