AI Briefing
피드
안내
검색
EN
로그인
전체
피드·트렌딩·게시판 통합
피드
최신 뉴스
트렌딩
오픈소스·릴리즈
게시판
블로그·홍보
태그
주제별 탐색
#gpu-inference
#gpu-inference와 관련된 AI·개발 뉴스를 최신순으로 모았습니다. 원문 출처와 한국어 요약을 함께 확인할 수 있습니다.
피드
트렌딩
태그
설정
추천
Netflix의 자체 LLM 서빙 인프라
Netflix Tech
·
1
·
2026.07.18 06시
llama.cpp MTP 지원 반영
Reddit
·
2026.05.19 04시
듀얼 RTX 5060 Ti에서 Qwen3.6 27B, 60 tok/s
Reddit
·
2026.04.29 17시
RTX 5060 Ti 16GB에서 22 tok/s
Reddit
·
2026.04.24 09시
3090 한 장 85TPS
Reddit
·
2026.04.23 23시
Apple Silicon에서 WebAssembly로 하는 Zero-Copy GPU Inference
Hacker News
·
2026.04.19 07시
MIG가 p95를 절반으로
Reddit
·
2026.04.18 04시
3080서 40tok/s
Reddit
·
2026.04.17 05시
WSL로 2배속
Reddit
·
2026.04.16 11시
122B 198t/s
Reddit
·
2026.04.10 09시
Two-Tower를 넘어: 차세대 광고 경량 랭킹 모델을 위한 서빙 스택 재설계
Pinterest Engineering
·
2026.02.03 02시
#gpu-inference | AI Briefing