AI Briefing
피드
안내
검색
EN
로그인
전체
피드·트렌딩·게시판 통합
피드
최신 뉴스
트렌딩
오픈소스·릴리즈
게시판
블로그·홍보
태그
주제별 탐색
#vllm
#vllm와 관련된 AI·개발 뉴스를 최신순으로 모았습니다. 원문 출처와 한국어 요약을 함께 확인할 수 있습니다.
피드
트렌딩
태그
설정
#vllm 3페이지 | AI Briefing
DeepLearning.AI, vLLM 공식 강의 출시
Reddit
·
2026.06.05 02시
KVarN: Huawei가 개발한 vLLM 네이티브 KV-cache 양자화 백엔드
Hacker News
·
2026.06.05 00시
AMD MI300X에서 DeepSeek-V4-Flash 구동하기
Hacker News
·
2026.06.03 02시
추천
NVIDIA, Qwen3.6 NVFP4 공개
Reddit
·
2026.05.31 02시
vLLM, AMD용 HIP W4A16 커널 지원
Reddit
·
2026.05.29 21시
Hub Bucket을 활용한 1조 파라미터 전송: TRL의 Delta Weight Sync
TLDR AI
·
2026.05.27 09시
유휴 Inference GPU Pool을 이용한 GPU Job 스케줄링
GeekNews
·
1
·
2026.05.27 08시
Harbor, 로컬 LLM 에이전트 실행 지원
Reddit
·
2026.05.26 23시
Eagle 3.1: EAGLE 팀, vLLM 팀, TorchSpec 팀의 협업
Hacker News
·
2026.05.26 20시
BadHost – CVE-2026-48710: Starlette Host-Header 인증 우회 취약점
Hacker News
·
2026.05.26 18시
Utilyze - GPU가 실제로 유용한 작업을 얼마나 효율적으로 수행하는지 측정하는 도구
GeekNews
·
1
·
2026.05.22 09시
Marlin-2B 영상 구조화 VLM 공개
Reddit
·
2026.05.19 18시
정확도를 희생하지 않고 LLM을 더 빠르게
Amazon Science
·
2026.05.15 22시
vLLM, Qwen3.5 Vision 템플릿 오류 수정
Reddit
·
2026.05.15 19시
TurboQuant 정확도·성능 평가
Reddit
·
2026.05.15 05시
Borealis, 오디오 LLM 레시피 공개
Reddit
·
2026.05.12 23시
MiniCPM-V 4.6 공개
Product Hunt
·
2026.05.12 18시
Amazon EKS에서 운영하는 자체 관리형 Agentic AI 플랫폼: 인프라 자동화와 관측성으로 운영 안정성 확보하기
AWS Tech Blog (한국)
·
2026.05.11 13시
Lemonade에 vLLM ROCm 추가
Reddit
·
2026.05.09 03시
vLLM V0에서 V1로: RL에서 보정보다 정확성 먼저
TLDR AI
·
1
·
2026.05.07 06시
vLLM 기반 encoder 서빙 도구 공개
Reddit
·
2026.05.06 20시
vLLM, Qwen TurboQuant 오류 수정
Reddit
·
2026.05.05 09시
vLLM 라우팅과 KV (16분 읽기)
TLDR AI
·
2026.05.04 09시
4장 5060 Ti vLLM 벤치
Reddit
·
2026.04.30 01시
이전
1
2
3
4
5
다음
이전
1
2
3
4
5
다음