AI Briefing

FuriosaAI의 RNGD에 주목해야 하는 이유

·2024.08.26 09:00

FuriosaAI가 저전력·고성능 AI 추론을 위한 신제품 **RNGD**를 공개했다.

현재 LLM 및 멀티모달 모델을 프로덕션 환경에서 운영하는 것은 막대한 비용과 기술적 난제를 동반한다. 고성능 GPU는 높은 초기 비용뿐만 아니라, 개별 카드당 1,000W 이상의 전력을 소비하여 전기 요금 급증, 복잡한 액체 냉각 시스템, 기존 서버 인프라와의 호환성 문제를 야기한다.

FuriosaAI의 RNGD(발음: Renegade)는 이러한 문제를 해결하기 위해 설계된 AI 가속기다. Llama 3.1 70B와 같은 모델을 안정적으로 구동하며, 다음과 같은 핵심 강점을 제공한다.

  • 효율성: 180W TDP로 매우 낮은 전력 소비를 실현했다.
  • 성능: 고성능 LLM 워크로드를 원활하게 처리한다.
  • 프로그래밍 가능성: 컴파일러가 모델 전체를 단일 융합 연산(fused operations)으로 처리하여, 번거로운 수동 커널 최적화 과정을 생략할 수 있다.

RNGD는 효율성, 성능, 프로그래밍 가능성의 균형을 맞추기 위해 **Tensor Contraction Processor(TCP)**라는 새로운 칩 아키텍처를 기반으로 설계되었다. 또한 HBM35nm 공정을 도입하여 기술적 완성도를 높였다.

이를 통해 기업은 에너지 및 인프라 비용을 절감하여 **총 소유 비용(TCO)**을 낮출 수 있다. 또한 일반 CPU 서버처럼 온프레미스나 클라우드에 간편하게 배포할 수 있어 운영 효율성을 극대화하고, 탄소 발자국을 줄이는 지속 가능성까지 확보했다.

이 요약은 원문 이해를 돕기 위한 큐레이션입니다. 저작권은 원저작자에게 있으며, 정확한 내용과 맥락은 원문을 확인하세요.

요약 오류, 출처 표기 문제, 삭제 요청은 문의 · 건의로 알려주세요.