AI Briefing
피드
안내
개발
검색
로그인
전체
피드·트렌딩·게시판 통합
피드
최신 뉴스
주간
주간·월간 인기
트렌딩
오픈소스·릴리즈
게시판
블로그·홍보
태그
주제별 탐색
#inference-engine
피드
트렌딩
주간
태그
설정
WASTE 추론 엔진
TLDR AI
·
2026.07.31 09시
Ling-3.0-flash 추론 엔진 지원 현황
Reddit
·
2026.07.28 01시
transcribe.cpp
Hacker News
·
2026.07.19 09시
Netflix의 자체 LLM 서빙 시스템 구축
Netflix Tech
·
2026.07.18 06시
colibri: 소비자용 PC에서 744B MoE 실행
PyTorchKR 읽을거리
·
2026.07.14 15시
GPU 버블 깨뜨리기
Hacker News
·
2026.06.30 14시
llama.cpp, Vulkan 백엔드 및 신규 모델 지원 업데이트
Reddit
·
2026.06.24 18시
Rust 기반의 안전한 GPU 추론 엔진 cuTile 공개
Reddit
·
2026.06.19 06시
mistral.rs, OpenAI 호환 Agent Skills 지원
Reddit
·
2026.06.19 00시
에이전트 코딩에 로컬 LLM 활용하기
GeekNews
·
1
·
2026.06.15 09시
Alibaba T-Head AI 스택의 실체
Reddit
·
2026.06.05 07시
mistral.rs, Gemma 4 12B 지원
Reddit
·
2026.06.04 20시
mistral.rs, CUDA 추론 성능 대폭 개선
Reddit
·
2026.06.01 23시
Apple Silicon용 추론 엔진 Conifer 공개
Reddit
·
2026.05.26 07시
vLLM, Qwen3.5 Vision 템플릿 오류 수정
Reddit
·
2026.05.15 19시
ds4.c (GitHub 저장소)
TLDR AI
·
2026.05.08 09시
TokenSpeed: 에이전트 워크로드용 초고속 LLM 추론 엔진
TLDR AI
·
2026.05.07 09시
초고속 추론 엔진 Atlas 오픈 소스 공개
Reddit
·
2026.05.07 05시
Apple Silicon용 MTP 추론 엔진 MTPLX
Reddit
·
2026.05.05 09시
hipfire HFQ4 prefill 3배 향상
Reddit
·
1
·
2026.04.28 14시
AMD GPU용 추론 엔진 Hipfire 공개
Reddit
·
2026.04.27 10시
에이전틱 워크로드용 Inference Engine 벤치마킹
TLDR AI
·
2026.04.23 09시
LM Studio Headless CLI와 Claude Code로 로컬에서 Google Gemma 4 실행하기
GeekNews
·
2026.04.07 02시
HuggingFace, Transformers를 AI 모델 정의의 표준으로 추진
HuggingFace Blog
·
2025.05.15 09시