Fireworks.ai, HF 추론 제공자로 추가
Welcome Fireworks.ai on the Hub 🎆
·2025.02.14 09:00
Fireworks.ai가 Hugging Face Hub의 서버리스 추론 제공자로 추가되어 주요 LLM을 지원한다.
Fireworks.ai가 Hugging Face Hub의 Inference Provider로 공식 지원된다. 이를 통해 개발자는 Hugging Face 생태계 내에서 Fireworks.ai의 고속 서버리스 추론 기능을 모델 페이지에서 직접 활용할 수 있다.
주요 지원 모델은 다음과 같다:
- DeepSeek-R1, DeepSeek-V3
- Mistral-Small-24B-Instruct-2501
- Qwen2.5-Coder-32B-Instruct
- Llama-3.2-90B-Vision-Instruct
사용자는 Hugging Face 웹사이트 UI뿐만 아니라 Python(huggingface_hub), JavaScript(@huggingface/inference) SDK 및 HTTP/cURL을 통해 간편하게 호출할 수 있다.
과금 방식은 Fireworks.ai API 키를 직접 사용하거나 Hugging Face를 통해 라우팅하는 방식 모두 Fireworks의 표준 요율이 적용된다. 또한, Hugging Face PRO 사용자는 매월 2달러 상당의 추론 크레딧을 제공받아 다양한 제공자를 대상으로 사용할 수 있다.
이 요약은 원문 이해를 돕기 위한 큐레이션입니다. 저작권은 원저작자에게 있으며, 정확한 내용과 맥락은 원문을 확인하세요.
요약 오류, 출처 표기 문제, 삭제 요청은 문의 · 건의로 알려주세요.