AI Briefing
추천

Google, Gemma 4 업데이트 및 Flash Attention 4 지원

Google is updating Gemma 4's chat templates, bringing major fixes to tool calling and reducing "laziness", and enabling Flash Attention 4 on Hopper GPUs, plus an interactive guide on how to work with and improve its vision!

·2026.07.16 04:26

핵심 내용

Google이 Gemma 4의 채팅 템플릿을 업데이트하여 도구 호출 성능을 개선하고 Flash Attention 4를 지원합니다.

자세히 보기

Google이 Gemma 4 모델의 성능과 사용성을 높이기 위한 주요 업데이트를 발표했습니다.

주요 업데이트 내용은 다음과 같습니다:

  • 채팅 템플릿 업데이트: Tool Calling(도구 호출) 관련 버그를 수정하고, 모델이 답변을 생략하는 'Laziness' 현상을 완화했습니다.
  • 추론 최적화: NVIDIA Hopper GPU에서 Flash Attention 4를 사용할 수 있도록 지원하여 추론 효율성을 높였습니다.
  • Vision 기능 강화: 모델의 시각적 이해 능력을 활용하고 개선할 수 있는 인터랙티브 가이드를 제공합니다.

이 한국어 요약은 AI가 자동으로 만들었습니다. 원문의 주장과 맥락은 원문에서 확인해 주세요. 저작권은 원저작자에게 있습니다.

AI 처리 방식을 확인하거나, 요약 오류와 출처 표기 문제, 삭제 요청을 문의 · 건의로 알려주세요.