AI Briefing
피드
안내
검색
EN
로그인
전체
피드·트렌딩·게시판 통합
피드
최신 뉴스
트렌딩
오픈소스·릴리즈
게시판
블로그·홍보
태그
주제별 탐색
#model-serving
#model-serving와 관련된 AI·개발 뉴스를 최신순으로 모았습니다. 원문 출처와 한국어 요약을 함께 확인할 수 있습니다.
피드
트렌딩
태그
설정
#model-serving 2페이지 | AI Briefing
Stripe, OpenRouter 인수 협상 착수
GeekNews
·
2026.07.27 05시
NVIDIA, ModelExpress 공개
Reddit
·
2026.07.25 17시
집에서 BitTorrent 방식으로 대형 언어 모델 실행하기
Hacker News
·
2026.07.23 10시
pi 0.81.0, llama.cpp 지원 추가
Reddit
·
2026.07.22 00시
ExLlamaV3 v1.0.0 정식 출시
Reddit
·
2026.07.15 16시
Weave Router, 프롬프트별 최적 모델 자동 라우팅으로 비용 40-70% 절감
GeekNews
·
2026.07.09 09시
vLLM, Transformers 백엔드 성능 대폭 개선
HuggingFace Blog
·
2026.07.08 09시
gVisor Snapshotting을 통한 GPU Cold Start 시간 단축
Hacker News
·
2026.07.02 01시
Micro-Agent: 모델 API 내부의 협업을 통해 프론티어 모델을 압도하라
Hacker News
·
2026.06.30 03시
DeepLearning.AI, vLLM 공식 강의 출시
Reddit
·
2026.06.05 02시
Standard GPU에서의 실시간 LLM 추론: 요청당 3,000 tokens/s
Hacker News
·
2026.05.29 18시
Forge - 가드레일로 8B 모델의 에이전트 작업 성공률을 53%에서 99%로 끌어올리는 도구
GeekNews
·
2026.05.20 17시
LM Studio, MTP 지원 추가
Reddit
·
2026.05.20 12시
llama.cpp, MTP 개선 반영
Reddit
·
2026.05.19 21시
Claude Code 성능저하 원인
Reddit
·
2026.05.19 00시
PaddleOCR 3.5, Transformers 백엔드 지원
HuggingFace Blog
·
2026.05.19 00시
Osaurus, Mac용 로컬·클라우드 AI 서버
Reddit
·
2026.05.18 14시
Thinking Machines, 상호작용 모델 공개
Reddit
·
1
·
2026.05.14 11시
AWS, 파운데이션 모델 인프라 정리
HuggingFace Blog
·
1
·
2026.05.12 08시
ExLlamaV3 대규모 업데이트
Reddit
·
2026.05.11 16시
카카오, Kanana-O 음성 AI 서빙 최적화 기술 공개… OpenAI API 호환·프로세스 격리 적용
카카오
·
2026.05.06 00시
LLM 학습 및 서빙 메커니즘 분석
Reddit
·
2026.05.04 16시
Model Serving 라우팅의 현주소
Netflix Tech
·
2026.05.02 06시
Z.AI, GLM-5 인프라 이슈 해결
Reddit
·
2026.05.01 00시
이전
1
2
3
다음
이전
1
2
3
다음