AI Briefing
피드
안내
검색
EN
로그인
전체
피드·트렌딩·게시판 통합
피드
최신 뉴스
트렌딩
오픈소스·릴리즈
게시판
블로그·홍보
태그
주제별 탐색
#speculative-decoding
#speculative-decoding와 관련된 AI·개발 뉴스를 최신순으로 모았습니다. 원문 출처와 한국어 요약을 함께 확인할 수 있습니다.
피드
트렌딩
태그
설정
#speculative-decoding 2페이지 | AI Briefing
JetSpec, LLM 추론 속도 최대 9.64배 향상
Reddit
·
2026.06.26 06시
코딩 생성(Codegen) 속도 최적화를 위한 모델 최적화 전략
TLDR AI
·
2026.06.22 09시
분산형 AI 추론 속도 15배 향상
Reddit
·
1
·
2026.06.20 19시
PIX-TAB: Speculative Decoding과 영역 기반 이미지 분할을 활용한 효율적인 픽셀 정밀 테이블 구조 인식 방식
Samsung Research
·
2026.06.17 09시
DFlash 및 Spec V2 디코딩 기술
TLDR AI
·
2026.06.16 09시
EAGLE3, llama.cpp에 통합 완료
Reddit
·
2026.06.12 16시
샤오미의 MiMo, ChatGPT 및 Claude보다 15배 빠른 속도 구현
TLDR AI
·
2026.06.09 09시
Gemma 4 QAT MTP 헤드 공개 및 오류 수정
Reddit
·
1
·
2026.06.07 06시
Domino: 추론 속도 5.8배 향상
Reddit
·
2026.06.06 21시
llama.cpp, Intel Arc 성능 45% 향상
Reddit
·
2026.06.06 03시
Speculative KV coding: KV cache를 최대 ~4배까지 무손실 압축하기
Hacker News
·
2026.06.05 00시
MTP 헤드 통합 GGUF 출시
Reddit
·
1
·
2026.05.31 14시
Qwen3.6-35B MTP 적용, 추론 속도 1.49배 향상
Reddit
·
1
·
2026.05.30 05시
LM Studio, MTP 지원 추가
Reddit
·
2026.05.20 12시
llama.cpp, MTP 개선 반영
Reddit
·
2026.05.19 21시
llama.cpp MTP 지원 반영
Reddit
·
2026.05.19 04시
llama.cpp b9180 MTP 지원
Reddit
·
2026.05.17 02시
llama.cpp MTP 지원 추가
Reddit
·
2026.05.16 21시
Orthrus-Qwen3-8B 7.8배 가속
Reddit
·
2026.05.16 04시
Attention Drift 발견
Reddit
·
2026.05.13 04시
llama.cpp, MTP와 멀티모달 통합 지원 준비
Reddit
·
2026.05.12 07시
BeeLlama.cpp: llama.cpp 최적화
Reddit
·
2026.05.10 01시
Gemma 4 MTP 드래프터 공개
Reddit
·
2026.05.07 07시
Qwen 3.6, MTP 지원으로 추론 속도 2.5배 향상
Reddit
·
2026.05.06 18시
이전
1
2
3
다음
이전
1
2
3
다음