AI Briefing
피드
안내
검색
EN
로그인
전체
피드·트렌딩·게시판 통합
피드
최신 뉴스
트렌딩
오픈소스·릴리즈
게시판
블로그·홍보
태그
주제별 탐색
#quantization
#quantization와 관련된 AI·개발 뉴스를 최신순으로 모았습니다. 원문 출처와 한국어 요약을 함께 확인할 수 있습니다.
피드
트렌딩
태그
설정
#quantization 3페이지 | AI Briefing
추천
POCKET-Image: 온디바이스 한글 렌더링 해결
PyTorchKR 읽을거리
·
2
·
2026.07.26 17시
LLM의 통계적 무손실 양자화 기술 SLQ 공개
Reddit
·
2026.07.25 03시
audio.cpp 0.4, TTS 35개 모델 패밀리 지원
Reddit
·
2026.07.24 09시
Diffusers, Nunchaku 4비트 양자화 공식 지원
HuggingFace Blog
·
2026.07.23 09시
BTL-3 27B 에이전트 모델 공개
Reddit
·
2026.07.23 04시
llama.cpp, AMD ROCm 성능 향상 및 버그 수정
Reddit
·
2026.07.21 15시
Qwen2.5-Coder 양자화 성능 연구 결과
Reddit
·
2026.07.20 16시
BeeLlama.cpp v0.4.0 출시
Reddit
·
2026.07.20 03시
재구성 오차와 다운스트림 성능의 불일치 연구
Reddit
·
2026.07.20 00시
llama.cpp, Bonsai 모델 추론 성능 개선
Reddit
·
2026.07.16 13시
Bonsai 27B: 1비트/삼진 양자화로 온디바이스 실행
PyTorchKR 읽을거리
·
2026.07.16 12시
colibri: 소비자용 PC에서 744B MoE 실행
PyTorchKR 읽을거리
·
2026.07.14 15시
Unsloth, Qwen3.6 NVFP4 양자화 출시
Reddit
·
1
·
2026.07.13 19시
ggml, Ternary Bonsai 지원 위한 Q2_0 양자화 추가
Reddit
·
2026.07.08 23시
Sana 1.6B 모델, 1.58비트 양자화 공개
Reddit
·
2026.06.28 14시
EdgeRazor: 1.58-bit 양자화 지원 경량 LLM 프레임워크
Reddit
·
2026.06.25 01시
OSCAR: 2-bit KV Cache 양자화 기술 공개
Reddit
·
2026.06.10 04시
Gemma 4를 활용한 3가지 빌더들의 사례
Google AI Blog
·
1
·
2026.06.10 01시
llama.cpp WebGPU 추론 성능 개선
Reddit
·
2026.06.09 11시
NanoQuant: 1비트 미만 양자화 구현
Reddit
·
2026.06.09 01시
Gemma 4 QAT MTP 헤드 공개 및 오류 수정
Reddit
·
1
·
2026.06.07 06시
Launch HN: General Instinct (YC P26) – 엣지 디바이스를 위한 프론티어 모델
Hacker News
·
2026.06.06 01시
추천
Gemma 4 QAT 모델: 모바일 및 노트북 효율을 위한 모델 압축 최적화
TLDR AI
·
2026.06.06 01시
Unsloth, Gemma 4 GGUF 가중치 공개
Reddit
·
2026.06.06 00시
이전
1
2
3
4
5
다음
이전
1
2
3
4
5
6
7
8
9
10
다음