AI Briefing

Hugging Face, PRO용 Inference API 출시

Inference for PROs

·2023.09.22 09:00

핵심 내용

Hugging Face가 PRO 구독자에게 고성능 모델 전용 API와 높은 사용량 제한을 제공하는 'Inference for PRO'를 출시했다.

자세히 보기

Hugging Face가 PRO 구독자를 대상으로 최신 모델에 대한 고속 추론 API를 제공하는 Inference for PRO 서비스를 출시했다.

이 서비스는 text-generation-inference를 활용하여 엄선된 모델들에 대해 초고속 추론이 가능한 전용 HTTP 엔드포인트를 제공한다. PRO 사용자는 기존 무료 Inference API보다 높은 **Rate Limit(사용량 제한)**을 적용받으며, 다음과 같은 주요 모델들을 즉시 사용할 수 있다:

  • LLM: Meta Llama 3 (8B, 70B), Mixtral 8x7B, Zephyr 7B, Code Llama 등
  • 이미지 생성: Stable Diffusion XL
  • 오디오 생성: Bark

본 서비스는 자체 인프라 구축 없이도 최신 모델을 빠르게 테스트하고 프로토타이핑하는 데 최적화되어 있다. 다만, 대규모 프로덕션 환경을 구축하려는 경우에는 전용 서비스인 Inference Endpoints 사용이 권장된다.

이 한국어 요약은 AI가 자동으로 만들었습니다. 원문의 주장과 맥락은 원문에서 확인해 주세요. 저작권은 원저작자에게 있습니다.

AI 처리 방식을 확인하거나, 요약 오류와 출처 표기 문제, 삭제 요청을 문의 · 건의로 알려주세요.