AI Briefing
피드
안내
개발
검색
로그인
전체
피드·트렌딩·게시판 통합
피드
최신 뉴스
주간
주간·월간 인기
트렌딩
오픈소스·릴리즈
게시판
블로그·홍보
태그
주제별 탐색
#gpu-inference
피드
트렌딩
주간
태그
설정
추천
Netflix의 자체 LLM 서빙 인프라
Netflix Tech
·
1
·
2026.07.18 06시
llama.cpp MTP 지원 반영
Reddit
·
2026.05.19 04시
듀얼 RTX 5060 Ti에서 Qwen3.6 27B, 60 tok/s
Reddit
·
2026.04.29 17시
RTX 5060 Ti 16GB에서 22 tok/s
Reddit
·
2026.04.24 09시
3090 한 장 85TPS
Reddit
·
2026.04.23 23시
Two-Tower를 넘어: 차세대 광고 경량 랭킹 모델을 위한 서빙 스택 재설계
Pinterest Engineering
·
2026.02.03 02시