AI Briefing
피드
안내
검색
EN
로그인
전체
피드·트렌딩·게시판 통합
피드
최신 뉴스
트렌딩
오픈소스·릴리즈
게시판
블로그·홍보
태그
주제별 탐색
#quantization
#quantization와 관련된 AI·개발 뉴스를 최신순으로 모았습니다. 원문 출처와 한국어 요약을 함께 확인할 수 있습니다.
피드
트렌딩
태그
설정
TextCLF, 캘리브레이션 없는 TQ 양자화 공개
Reddit
·
2026.09.25 07시
UkisAI, Swift Qwen 모델 공개
Reddit
·
2026.09.25 01시
Hugging Face, Transformers에 GGUF 네이티브 지원 도입
Reddit
·
2026.09.23 14시
K2-Horizon GGUF 양자화 공개
Reddit
·
2026.09.23 05시
TextCLF, 캘리브레이션 없는 4비트 양자화 도구 공개
Reddit
·
2026.09.23 03시
Gemma 4 31B 최적화 추론 엔진 'Gewell' 공개
Reddit
·
2026.09.21 18시
PrismML, FP16 성능 98.2% 유지하는 삼진 양자화 모델 'Ternary Bonsai 2 27B' 공개
PyTorchKR 읽을거리
·
2026.09.19 11시
Gemma 멀티모달 추론용 단일 파일 C 엔진 공개
Reddit
·
2026.09.16 19시
2026년 AI 추론 하드웨어 혁신: Prefill/Decode 분할과 메모리 병목 해결을 위한 새로운 아키텍처
GeekNews
·
2
·
2026.09.15 22시
Voodoo Dynamic Quant, MIT 라이선스 공개
Reddit
·
2026.09.15 15시
Pinterest, 임베딩 검색 플랫폼 Manas의 SSD 서빙 및 양자화 기술로 비용 최대 30% 절감
당근
·
2026.09.15 09시
Edge0, SSD 스트리밍으로 35B MoE 모델 3GiB 메모리 실행
PyTorchKR 읽을거리
·
2026.09.15 08시
Pinterest의 임베딩 검색 플랫폼 진화
Pinterest Engineering
·
2026.09.12 00시
Bartowski, GGUF 모델용 새로운 텐서 레이아웃 맵 적용
Reddit
·
2026.09.11 04시
NVIDIA Cosmos3 64B, INT4 양자화 버전 공개
Reddit
·
2026.09.09 23시
NVIDIA, 모델 경량화 도구 공개
PyTorchKR 읽을거리
·
1
·
2026.09.02 09시
LLM 추론의 효율적 프론티어 (6분 분량)
TLDR AI
·
2
·
2026.09.02 09시
NVIDIA, DeepSeek-V4-Pro-0813의 NVFP4 양자화 모델 공개
TLDR AI
·
2026.08.31 09시
Qwen3-Coder 4bit TQ 공개
Reddit
·
2026.08.31 05시
Qwen3.8-27B SOTA GGUF 공개
Reddit
·
1
·
2026.08.29 06시
GGUF 파일명-실제 비트 불일치
Reddit
·
2026.08.29 05시
Ollama KV 캐시 설정의 함정
Reddit
·
2026.08.28 06시
ik_llama.cpp 신규 기능 업데이트
Reddit
·
2026.08.27 16시
Qwen3.8-27B NVFP4 양자화 공개
Reddit
·
2026.08.26 10시
이전
1
2
3
4
5
다음
이전
1
2
3
4
5
6
7
8
9
10
다음
#quantization | AI Briefing