AI Briefing

Hugging Face, Google TPU 지원

Google Cloud TPUs made available to Hugging Face users

·2024.07.09 09:00

핵심 내용

Hugging Face의 Inference Endpoints와 Spaces에서 Google Cloud TPU v5e를 사용할 수 있게 되었다.

1 / 2

자세히 보기

Hugging Face가 Google Cloud와의 협업을 통해 Inference Endpoints 및 Spaces에서 Google Cloud TPU v5e를 지원한다. AI 개발자들은 이를 통해 모델 배포 및 데모 실행 시 더 높은 성능과 비용 효율성을 확보할 수 있다.

Inference Endpoints에서 제공되는 TPU v5e 구성은 다음과 같다:

  • v5litepod-1: 1코어, 16GB 메모리 ($1.375/시간)
  • v5litepod-4: 4코어, 64GB 메모리 ($5.50/시간)
  • v5litepod-8: 8코어, 128GB 메모리 ($11.00/시간)

대규모 모델의 원활한 구동을 위해 v5litepod-4 이상의 구성을 권장한다.

Hugging Face Spaces에서도 동일한 세 가지 TPU v5e 인스턴스 구성을 지원하여 AI 데모를 빠르게 구축할 수 있다.

이번 협업의 일환으로 오픈소스 라이브러리인 Optimum TPU가 개발되었으며, 이를 통해 Gemma, Llama, Mistral 등 주요 모델을 간편하게 배포할 수 있다.

이 한국어 요약은 AI가 자동으로 만들었습니다. 원문의 주장과 맥락은 원문에서 확인해 주세요. 저작권은 원저작자에게 있습니다.

AI 처리 방식을 확인하거나, 요약 오류와 출처 표기 문제, 삭제 요청을 문의 · 건의로 알려주세요.