AI Briefing

Hugging Face-Cerebras, 실시간 음성 AI 파이프라인 공개

Hugging Face and Cerebras bring Gemma 4 to real-time voice AI

·2026.07.01 09:00

Hugging Face와 Cerebras가 Gemma 4를 활용해 초저지연 실시간 음성-대-음성(Speech-to-Speech) 기술을 선보였다.

Hugging Face와 Cerebras는 모델 품질과 응답 속도 사이의 간극을 줄이기 위해 초저지연 실시간 음성 AI 파이프라인을 공개했습니다. 이번 기술은 오픈 소스 생태계의 다양한 모델을 결합한 모듈형 아키텍처를 특징으로 합니다.

전체 시스템은 다음과 같은 오픈 스택(Open Stack) 구조로 동작합니다:

  • 음성 인식(ASR): Nvidia의 Parakeet
  • 언어 모델(LLM): Google DeepMind의 Gemma 4 31B (Cerebras 추론 엔진 사용)
  • 음성 합성(TTS): Alibaba의 Qwen3TTS

특히 Cerebras의 고속 추론 엔진은 언어 모델의 응답 시간을 획기적으로 단축하여, 대화의 흐름이 끊기지 않는 자연스러운 사용자 경험을 제공합니다. 이 기술은 현재 9,000대 이상의 로봇에 적용된 Reachy Mini 로봇의 음성 인터페이스에도 활용되어, 로봇과 인간 간의 실시간 상호작용을 가능하게 합니다.

이 요약은 원문 이해를 돕기 위한 큐레이션입니다. 저작권은 원저작자에게 있으며, 정확한 내용과 맥락은 원문을 확인하세요.

요약 오류, 출처 표기 문제, 삭제 요청은 문의 · 건의로 알려주세요.