AI Briefing

Gemini 3.1 Flash Live: 더 자연스럽고 신뢰할 수 있는 오디오 AI 구현

·2026.03.27 00:21

Google이 실시간 대화 능력을 강화한 고품질 오디오 및 음성 모델 Gemini 3.1 Flash Live를 공개했다.

Google이 실시간 대화 능력을 한 단계 높인 Gemini 3.1 Flash Live를 선보였다. 이 모델은 차세대 음성 중심 AI에 필요한 속도와 자연스러운 리듬을 제공하며, 개발자, 기업 및 일반 사용자 모두에게 직관적인 경험을 제공한다.

Gemini 3.1 Flash Live는 다음과 같이 다양한 경로로 제공된다.

  • 개발자: Google AI Studio의 Gemini Live API를 통해 프리뷰 제공
  • 기업: Gemini Enterprise for Customer Experience에서 활용 가능
  • 일반 사용자: Search Live 및 Gemini Live를 통해 이용 가능

성능 면에서도 괄목할 만한 성과를 보였다. ComplexFuncBench Audio 벤치마크에서 90.8%를 기록하며 복잡한 다단계 함수 호출 능력을 입증했으며, Scale AI의 Audio MultiChallenge에서는 'Thinking' 모드 시 36.1%를 기록해 실제 대화 중 발생하는 방해나 망설임 속에서도 뛰어난 추론 능력을 보여주었다.

또한 음조 이해 능력이 향상되어 피치(pitch)나 속도(pace)와 같은 음향적 미묘함을 더 잘 인식한다. 이를 통해 사용자의 좌절감이나 혼란스러운 표현에 맞춰 응답을 동적으로 조정하며 더욱 자연스러운 대화를 구현한다.

이 요약은 원문 이해를 돕기 위한 큐레이션입니다. 저작권은 원저작자에게 있으며, 정확한 내용과 맥락은 원문을 확인하세요.

요약 오류, 출처 표기 문제, 삭제 요청은 문의 · 건의로 알려주세요.