AI Briefing
피드
안내
개발
검색
로그인
전체
피드·트렌딩·게시판 통합
피드
최신 뉴스
주간
주간·월간 인기
트렌딩
오픈소스·릴리즈
게시판
블로그·홍보
태그
주제별 탐색
#sglang
피드
트렌딩
주간
태그
설정
더 작고 빠르고 안전하게: Kimi와 GLM을 대규모로 실행하기
Cloudflare Blog
·
2026.08.03 22시
버스트형 LLM 추론을 위한 예측적 Speculative KV Replication
Hacker News
·
2026.08.01 04시
Ling-3.0-flash 추론 엔진 지원 현황
Reddit
·
2026.07.28 01시
에이전트 기반의 SGLang 개발 방식
TLDR AI
·
2026.07.03 09시
Miles: 대규모 LLM RL 사후 학습을 위한 PyTorch 네이티브 스택
TLDR AI
·
2026.07.01 09시
DFlash 및 Spec V2 디코딩 기술
TLDR AI
·
2026.06.16 09시
OSCAR: 2-bit KV Cache 양자화 기술 공개
Reddit
·
2026.06.10 04시
Alibaba T-Head AI 스택의 실체
Reddit
·
2026.06.05 07시
Qwen3.7: 에이전트 최전선
Qwen
·
1
·
2026.05.20 11시
정확도를 희생하지 않고 LLM을 더 빠르게
Amazon Science
·
2026.05.15 22시
MiniCPM-V 4.6 공개
Product Hunt
·
2026.05.12 18시
SGLang FP8 KV·누수 수정
Reddit
·
2026.05.01 21시
GLM 5.1 로컬 40tps
Reddit
·
2026.04.26 01시
Gemma-4 미세 조정 및 배포 시 주의사항
Reddit
·
2026.04.19 07시
SGLang, Transformers 백엔드 통합
HuggingFace Blog
·
2025.06.23 09시