AI Briefing
피드
안내
검색
EN
로그인
전체
피드·트렌딩·게시판 통합
피드
최신 뉴스
트렌딩
오픈소스·릴리즈
게시판
블로그·홍보
태그
주제별 탐색
#quantization
#quantization와 관련된 AI·개발 뉴스를 최신순으로 모았습니다. 원문 출처와 한국어 요약을 함께 확인할 수 있습니다.
피드
트렌딩
태그
설정
#quantization 9페이지 | AI Briefing
표준 포맷 격상
HuggingFace Blog
·
2026.04.08 09시
Fujitsu One Compression (3분 읽기)
TLDR AI
·
2026.04.02 09시
AI21, Jamba 1.5 모델 제품군 공개
AI21 Labs
·
2026.03.25 20시
[Tech Series] kt cloud AI 검색 증강 생성(RAG) #4: 임베딩과 벡터 인덱싱 기술
KT Cloud
·
2026.03.23 16시
‘힘세고 강한 아침’을 넘어: GPT-4o-mini를 대체할 TranslateGemma 실험기
무신사
·
2026.03.16 07시
저비트 추론이 AI를 효율적으로 만드는 법
Dropbox Tech
·
2026.02.13 03시
온디바이스 AI 얼굴 검증 파이프라인 최적화
하이퍼커넥트
·
2026.01.23 09시
AI 추론 시스템의 총체적 최적화
FuriosaAI
·
2025.12.08 09시
Intel CPU용 VLM 최적화 및 실행 가이드
HuggingFace Blog
·
2025.10.15 09시
SD3.5-Flash: 생성형 Flow의 분포 유도 증류
Stability AI Research
·
2025.09.27 05시
transformers, gpt-oss 최적화 업데이트
HuggingFace Blog
·
2025.09.11 09시
FLUX.1-dev, 저사양 GPU로 QLoRA 학습
HuggingFace Blog
·
2025.06.19 09시
Diffusers 양자화 백엔드 비교 및 활용 가이드
HuggingFace Blog
·
2025.05.21 09시
Intel, 고성능 양자화 도구 AutoRound 공개
HuggingFace Blog
·
2025.04.29 09시
Intel 하드웨어용 LLM 최적화 및 배포
HuggingFace Blog
·
2024.09.20 09시
Llama 3 1.58비트 파인튜닝 기술 공개
HuggingFace Blog
·
2024.09.18 09시
로컬 LLM의 기반, ggml 라이브러리 입문
HuggingFace Blog
·
2024.08.13 09시
Quanto 기반 Diffusion 메모리 최적화
HuggingFace Blog
·
2024.07.30 09시
Hugging Face, KV Cache 양자화 기능 공개
HuggingFace Blog
·
2024.05.16 09시
Intel CPU에서 SetFit 추론 7.8배 가속
HuggingFace Blog
·
2024.04.03 09시
Hugging Face, 양자화 백엔드 'Quanto' 공개
HuggingFace Blog
·
2024.03.18 09시
Intel Xeon에서 StarCoder 추론 7배 가속
HuggingFace Blog
·
2024.01.30 09시
LLM 프로덕션 배포 최적화 가이드
HuggingFace Blog
·
2023.09.15 09시
🤗 Transformers 지원 양자화 방식 가이드
HuggingFace Blog
·
2023.09.12 09시
이전
6
7
8
9
10
다음
이전
1
2
3
4
5
6
7
8
9
10
다음