AI Briefing
피드
안내
검색
EN
로그인
전체
피드·트렌딩·게시판 통합
피드
최신 뉴스
트렌딩
오픈소스·릴리즈
게시판
블로그·홍보
태그
주제별 탐색
#model-serving
#model-serving와 관련된 AI·개발 뉴스를 최신순으로 모았습니다. 원문 출처와 한국어 요약을 함께 확인할 수 있습니다.
피드
트렌딩
태그
설정
TextCLF, 캘리브레이션 없는 TQ 양자화 공개
Reddit
·
2026.09.25 07시
LLM 추론 스택 8종 기능 및 용도 비교
Reddit
·
2026.09.19 01시
인텔, OpenVINO 2026.4 공개
Reddit
·
1
·
2026.09.17 18시
Reef, OpenClaw-RL 가중치 릴리스 게이트 레시피 공개
Reddit
·
2026.09.14 17시
Human-Agent-Society, 지속 학습 인프라 'Reef' 공개
PyTorchKR 읽을거리
·
2026.09.07 21시
vLLM v0.28.0 릴리스: Kimi-K3 및 DeepSeek V4 최적화, 추론 성능 대폭 향상
Hacker News
·
1
·
2026.08.30 03시
텍스트-음성 변환 모델이 50ms 미만으로 응답하도록 만든 방법
Hacker News
·
2026.08.22 00시
LLM 라우팅 라이브러리 LLMRouter 공개
Reddit
·
2026.08.16 01시
추천
Qwen3.8 2.4T 공개
HuggingFace Blog
·
1
·
2026.08.13 06시
Claude, 여러 모델 장애 조사
Reddit
·
2026.08.12 22시
WARP, 64GB 맥북서 K3 실행
PyTorchKR 읽을거리
·
1
·
2026.08.12 18시
SIE, 에이전트 모델 통합 서빙
PyTorchKR 읽을거리
·
2026.08.12 12시
추천
NVIDIA, Magpie TTS 공개
HuggingFace Blog
·
1
·
2026.08.11 01시
DeepSeek V4-Flash 출시
PyTorchKR 읽을거리
·
2026.08.06 09시
Hugging Face에 Baseten 연동
HuggingFace Blog
·
2026.08.06 09시
Intern S2 Mobius 공개
Reddit
·
2026.08.05 11시
MiniMax, H3 가중치 공개
PyTorchKR 읽을거리
·
1
·
2026.08.04 14시
단일 4GB GPU에서 AirLLM으로 70B 모델 추론
Hacker News
·
2026.08.03 20시
DS와 MLE가 함께 일하는 법
토스
·
2026.08.03 12시
WASTE, NVMe로 초대형 모델 실행
Reddit
·
2026.08.03 09시
llama.cpp 새 Mac 앱 공개
Reddit
·
2
·
2026.08.03 05시
우리가 자체 C 및 C++ 추론 엔진을 작성하는 이유
Hacker News
·
2026.08.01 01시
29GB RAM으로 Kimi K3를 0.50 tok/s로 실행하기
Hacker News
·
2026.07.31 23시
ModelExpress: 모델 아티팩트를 빛의 속도로 배포하기
TLDR AI
·
2026.07.27 09시
이전
1
2
3
다음
이전
1
2
3
다음
#model-serving | AI Briefing