AI Briefing
피드
안내
검색
EN
로그인
전체
피드·트렌딩·게시판 통합
피드
최신 뉴스
트렌딩
오픈소스·릴리즈
게시판
블로그·홍보
태그
주제별 탐색
#quantization
#quantization와 관련된 AI·개발 뉴스를 최신순으로 모았습니다. 원문 출처와 한국어 요약을 함께 확인할 수 있습니다.
피드
트렌딩
태그
설정
#quantization 2페이지 | AI Briefing
4비트 LLM, 원본 모델 성능 역전
HuggingFace Blog
·
1
·
2026.08.25 20시
Meta, 모바일용 MoE LLM 공개
Reddit
·
2
·
2026.08.25 03시
llama-cpp-turboquant, ConvRot 양자화 지원
Reddit
·
2026.08.24 10시
Qwen3.8-27B 2bit 양자화 공개
Reddit
·
2026.08.21 02시
Unsloth Dynamic 3.0 GGUF 공개
TLDR AI
·
2026.08.20 09시
Liquid AI, LFM2.5 Q4_0 공개
HuggingFace Blog
·
2026.08.19 22시
추천
Qwen3.8-27B 검열 제거 MLX 모델 공개
HuggingFace Blog
·
3
·
2026.08.19 11시
DFlash 2, Qwen 3.8 27B 지원
Reddit
·
1
·
2026.08.19 06시
24GB GPU에서 Qwen3.8 vs Qwen3.6 vs Gemma 4 비교 (10분 읽기)
TLDR AI
·
2026.08.18 09시
Qwen3.8-27B-Uncensored-MLX (4분 읽기)
TLDR AI
·
2026.08.18 09시
Hadamard 회전 기반 3비트 양자화 WarpQuant
Reddit
·
2026.08.16 10시
bitsandbytes 제작자, 신규 양자화 예고
Reddit
·
2026.08.14 22시
WARP, 64GB 맥북서 K3 실행
PyTorchKR 읽을거리
·
1
·
2026.08.12 18시
추천
Needle 2 - 스마트폰·웨어러블·스마트홈·로봇을 위한 14MB 에이전틱 LLM
GeekNews
·
1
·
2026.08.11 13시
NVFP4 증류, 내부 기하 보존
Reddit
·
2026.08.10 05시
Kimi K3 GGUF 공개
Reddit
·
2026.08.07 17시
LLM 추론 최적화의 핵심 기술: 양자화·KV 캐시·추론 칩
KT Cloud
·
2026.08.06 14시
LittleBit-2: 잠재 기하 정렬로 1비트 미만 LLM의 스펙트럼 에너지 이득 극대화
Samsung Research
·
1
·
2026.08.04 08시
더 작고 빠르고 안전하게: Kimi와 GLM을 대규모로 실행하기
Cloudflare Blog
·
2026.08.03 22시
MSLK 커널 레퍼런스(웹사이트)
TLDR AI
·
2026.08.03 09시
NanoQuant: 대규모 언어 모델의 효율적인 1비트 미만 양자화
Samsung Research
·
2026.08.03 08시
EdgeRazor, 1.88비트 LLM
Reddit
·
2026.08.03 04시
Escha-W2 (Hugging Face 저장소)
TLDR AI
·
2026.07.30 09시
BeeLlama.cpp v0.4.1 출시: KV 캐시 양자화 성능 개선
Reddit
·
2026.07.27 01시
이전
1
2
3
4
5
다음
이전
1
2
3
4
5
6
7
8
9
10
다음