AI Briefing

Hugging Face, Google TPU 지원

Google Cloud TPUs made available to Hugging Face users

·2024.07.09 09:00

Hugging Face의 Inference Endpoints와 Spaces에서 Google Cloud TPU v5e를 사용할 수 있게 되었다.

Hugging Face가 Google Cloud와의 협업을 통해 Inference EndpointsSpaces에서 Google Cloud TPU v5e를 지원한다. AI 개발자들은 이를 통해 모델 배포 및 데모 실행 시 더 높은 성능과 비용 효율성을 확보할 수 있다.

Inference Endpoints에서 제공되는 TPU v5e 구성은 다음과 같다:

  • v5litepod-1: 1코어, 16GB 메모리 ($1.375/시간)
  • v5litepod-4: 4코어, 64GB 메모리 ($5.50/시간)
  • v5litepod-8: 8코어, 128GB 메모리 ($11.00/시간)

대규모 모델의 원활한 구동을 위해 v5litepod-4 이상의 구성을 권장한다.

Hugging Face Spaces에서도 동일한 세 가지 TPU v5e 인스턴스 구성을 지원하여 AI 데모를 빠르게 구축할 수 있다.

이번 협업의 일환으로 오픈소스 라이브러리인 Optimum TPU가 개발되었으며, 이를 통해 Gemma, Llama, Mistral 등 주요 모델을 간편하게 배포할 수 있다.

이 요약은 원문 이해를 돕기 위한 큐레이션입니다. 저작권은 원저작자에게 있으며, 정확한 내용과 맥락은 원문을 확인하세요.

요약 오류, 출처 표기 문제, 삭제 요청은 문의 · 건의로 알려주세요.