AI Briefing

vLLM Recipes 개편 - 모델+하드웨어 조합별 설정을 딸각 한방으로

·2026.04.23 13:42

핵심 내용

vLLM Recipes가 하드웨어별 서빙 설정과 명령어 생성을 지원하도록 개편됐다.

자세히 보기

recipes.vllm.ai가 크게 개편되면서, 모델 X를 하드웨어 Y에서 어떻게 돌릴지를 웹에서 바로 찾고 생성할 수 있게 됐다.

주요 변화는 다음과 같다.

  • HuggingFace 미러 URL: huggingface.co를 recipes.vllm.ai로 바꾸면 해당 모델의 레시피 페이지로 바로 이동할 수 있다. 예: recipes.vllm.ai/Qwen/Qwen3.6-35B-A3B
  • 인터랙티브 커맨드 빌더: 하드웨어, variant, 병렬화 전략을 선택하면 바로 실행 가능한 vllm serve 명령어를 생성한다.
  • 플러그형 하드웨어 지원: NVIDIA Hopper/Blackwell과 AMD MI300X/MI355X를 원클릭으로 전환하며, 관련 플래그와 환경변수도 자동 적용한다.
  • JSON API 제공: 모든 레시피를 /.json 경로로 제공해 에이전트나 자동화 도구가 직접 소비할 수 있다.

레포지토리에는 에이전트 스킬도 포함돼 있어, 새 레시피를 벤치마크 실행부터 레시피 생성, PR 제출까지 이어서 기여할 수 있다.

레포지토리는 github.com/vllm-project/recipes다.

이 한국어 요약은 AI가 자동으로 만들었습니다. 원문의 주장과 맥락은 원문에서 확인해 주세요. 저작권은 원저작자에게 있습니다.

AI 처리 방식을 확인하거나, 요약 오류와 출처 표기 문제, 삭제 요청을 문의 · 건의로 알려주세요.