Microsoft, Foundry에서 Hugging Face 모델 지원
Hugging Face Models on Foundry Managed Compute
·2026.07.08 00:20
Microsoft가 Foundry 플랫폼을 통해 Hugging Face의 오픈 웨이트 모델을 원클릭으로 배포할 수 있는 Managed Compute 서비스를 출시했습니다.
Microsoft는 Microsoft Build 2026에서 Foundry Managed Compute와 Hugging Face 모델 통합을 발표했습니다. 이를 통해 개발자는 Hugging Face 생태계의 오픈 웨이트 모델을 Azure 인프라 위에서 클릭 한 번으로 손쉽게 배포할 수 있습니다.
Foundry 플랫폼의 주요 특징:
- 광범위한 모델 선택권: Microsoft, OpenAI, Anthropic, Meta, Mistral, DeepSeek, Hugging Face 등 다양한 모델을 단일 엔드포인트와 SDK(Python, C#, JS, Java)로 접근 가능합니다.
- Foundry Agent Service: 멀티 에이전트 오케스트레이션, 메모리, 지식 기반(Foundry IQ) 및 도구 연결 기능을 제공합니다.
- Managed Compute: vLLM, SGLang, TensorRT-LLM 등 최신 런타임을 지원하며, GPU 토폴로지를 자동으로 관리하는 PaaS(Platform-as-a-Service) 형태의 GPU 관리 서비스를 제공합니다.
기업용 기능 및 보안:
- 모든 모델은 기업용 보안, 거버넌스, 관측성(Observability) 및 통합 빌링 시스템을 공유합니다.
- 콘텐츠 안전 필터, 작업 준수 가드레일, AI 레드팀 에이전트, 프라이빗 네트워킹 및 Azure Policy 통합을 지원합니다.
- Pay-per-token 방식과 고성능 워크로드를 위한 Provisioned Throughput 외에도, GPU를 시간당 비용으로 지불하는 Managed Compute 옵션을 제공하여 비용 효율성을 높였습니다.
이 요약은 원문 이해를 돕기 위한 큐레이션입니다. 저작권은 원저작자에게 있으며, 정확한 내용과 맥락은 원문을 확인하세요.
요약 오류, 출처 표기 문제, 삭제 요청은 문의 · 건의로 알려주세요.