AI Briefing
피드
안내
개발
검색
로그인
전체
피드·트렌딩·게시판 통합
피드
최신 뉴스
주간
주간·월간 인기
트렌딩
오픈소스·릴리즈
게시판
블로그·홍보
태그
주제별 탐색
#speculative-decoding
피드
트렌딩
주간
태그
설정
Fast Gemma의 검증된 추론 최적화 레시피 (7분 읽기)
TLDR AI
·
2026.08.04 09시
풍부한 지능 구축
OpenAI Blog
·
1
·
2026.08.01 00시
llama.cpp, MTP 텐서 기본 로드 변경
Reddit
·
2026.07.30 03시
llama.cpp, DSpark 추측 디코딩 지원
Reddit
·
2026.07.28 20시
GLM-5.2를 위한 초고속 API 구축 방법 (5분 읽기)
TLDR AI
·
2026.07.27 09시
LG AI Research: ACL 2024를 통해 본 LLM 효율성 향상 연구
LG AI Research
·
2026.07.16 09시
llama.cpp, Tencent Hy3 모델 지원
Reddit
·
2026.07.14 11시
Show HN: Reame – 실행될수록 빨라지는 CPU 추론 서버
Hacker News
·
2026.07.12 01시
하드웨어 인지형 동적 투기적 디코딩 (Hardware Aware Dynamic Speculative Decoding)
Cohere
·
2026.07.11 01시
BlockPilot: 추론 속도를 높이는 적응형 블록 크기 예측
Reddit
·
2026.07.03 23시
DeepSeek, LLM 추론 속도를 최대 85%까지 높이는 새로운 프레임워크 'DSpark' 오픈 소스 공개
TLDR AI
·
2026.06.30 09시
DeepSeek, 추측적 디코딩용 DeepSpec 공개
Reddit
·
2026.06.28 23시
JetSpec, LLM 추론 속도 최대 9.64배 향상
Reddit
·
2026.06.26 06시
코딩 생성(Codegen) 속도 최적화를 위한 모델 최적화 전략
TLDR AI
·
2026.06.22 09시
분산형 AI 추론 속도 15배 향상
Reddit
·
1
·
2026.06.20 19시
PIX-TAB: Speculative Decoding과 영역 기반 이미지 분할을 활용한 효율적인 픽셀 정밀 테이블 구조 인식 방식
Samsung Research
·
2026.06.17 09시
DFlash 및 Spec V2 디코딩 기술
TLDR AI
·
2026.06.16 09시
EAGLE3, llama.cpp에 통합 완료
Reddit
·
2026.06.12 16시
샤오미의 MiMo, ChatGPT 및 Claude보다 15배 빠른 속도 구현
TLDR AI
·
2026.06.09 09시
Gemma 4 QAT MTP 헤드 공개 및 오류 수정
Reddit
·
1
·
2026.06.07 06시
Domino: 추론 속도 5.8배 향상
Reddit
·
2026.06.06 21시
llama.cpp, Intel Arc 성능 45% 향상
Reddit
·
2026.06.06 03시
Speculative KV coding: KV cache를 최대 ~4배까지 무손실 압축하기
Hacker News
·
2026.06.05 00시
MTP 헤드 통합 GGUF 출시
Reddit
·
1
·
2026.05.31 14시
이전
1
2
3
다음
이전
1
2
3
다음