AI Briefing
피드
안내
검색
EN
로그인
전체
피드·트렌딩·게시판 통합
피드
최신 뉴스
트렌딩
오픈소스·릴리즈
게시판
블로그·홍보
태그
주제별 탐색
#inference
#inference와 관련된 AI·개발 뉴스를 최신순으로 모았습니다. 원문 출처와 한국어 요약을 함께 확인할 수 있습니다.
피드
트렌딩
태그
설정
#inference 5페이지 | AI Briefing
GLM-5 대규모 서비스 중 발견한 race condition 버그 수정기 — Coding Agent 추론 인프라의 Scaling Pain
GeekNews
·
2026.04.30 10시
vLLM, Mistral 3.5 지원
Reddit
·
2026.04.29 05시
Qwen3.6 35B 속도 테스트
Reddit
·
2026.04.28 11시
2x 5060 Ti Qwen3.6 벤치마크
Reddit
·
1
·
2026.04.28 04시
Qwen3.6-27B vLLM 도커, 118 TPS
Reddit
·
2026.04.27 22시
Skymizer, 700B LLM 추론 카드 공개
Reddit
·
2026.04.27 21시
H100서 Gemma 4 E2B 우세
Reddit
·
2026.04.26 18시
vLLM에 Cohere MoE 추가
Reddit
·
2026.04.25 01시
Qwen3.6 27B 속도 공유
Reddit
·
2026.04.25 00시
T4 Qwen2.5 추론 챌린지
Reddit
·
2026.04.24 17시
vLLM Recipes 개편 - 모델+하드웨어 조합별 설정을 딸각 한방으로
GeekNews
·
2026.04.23 13시
에이전트 시대를 위한 두 개의 칩: Google의 8세대 TPU
GeekNews
·
2026.04.23 10시
Kimi Vendor Verifier - 추론 제공자의 정확성 검증
GeekNews
·
2026.04.23 03시
15B 슈퍼넷 공개
Reddit
·
2026.04.22 23시
에이전트 시대를 위한 두 개의 칩, 우리의 8세대 TPU
Hacker News
·
2026.04.22 21시
에이전트 시대를 위한 두 가지 특화 TPU 출시
Google AI Blog
·
2026.04.22 21시
INT3·INT2 KV 캐시 공개
Reddit
·
2026.04.22 15시
VRAM 한계 돌파
Reddit
·
2026.04.22 03시
5090서 77tps
Reddit
·
2026.04.21 09시
Kimi Vendor Verifier – 추론 제공자의 정확성 검증
Hacker News
·
2026.04.21 03시
AI 에이전트 비용도 기하급수적으로 오르고 있을까?
TLDR AI
·
2026.04.20 09시
H100 3GB 절약
Reddit
·
2026.04.19 18시
KV가 DC를 넘다
Reddit
·
2026.04.19 01시
엔비디아 대항 투자 러시
Reddit
·
2026.04.17 22시
이전
3
4
5
6
7
다음
이전
1
2
3
4
5
6
7
다음