Google, 온디바이스용 Gemma 3n 공개
Gemma 3n fully available in the open-source ecosystem!
·2025.06.26 09:00
Google의 멀티모달 모델 Gemma 3n이 다양한 오픈소스 라이브러리를 통해 공개되었다.
Google의 온디바이스 특화 멀티모달 모델인 Gemma 3n이 transformers, llama.cpp, ollama, MLX 등 주요 오픈소스 라이브러리를 통해 정식 공개되었습니다. 이 모델은 텍스트뿐만 아니라 이미지, 오디오, 비디오 입력을 모두 지원하는 네이티브 멀티모달 모델입니다.
이번에 출시된 모델은 E2B(실제 5B)와 E4B(실제 8B) 두 가지 크기로 제공됩니다. 'Effective(E)'라는 명칭에서 알 수 있듯이, 메모리 효율화 기술을 통해 실제 파라미터 수보다 훨씬 적은 VRAM(각각 2GB, 3GB)만으로도 구동이 가능하도록 설계되었습니다.
주요 기술적 특징:
- MatFormer 아키텍처: 중첩된 트랜스포머 설계를 통해 하드웨어 사양과 메모리 예산에 맞춰 레이어를 선택적으로 추출하여 사용할 수 있습니다.
- Per-Layer Embeddings (PLE): 임베딩을 CPU로 오프로딩하여 가속기 메모리 사용량을 획기적으로 줄였습니다.
- 멀티모달 인코더: 300M 파라미터 규모의 MobileNet-V5 비전 인코더와 USM 기반 오디오 인코더를 탑재했습니다.
- KV Cache 공유: 오디오 및 비디오의 긴 컨텍스트 처리를 가속화하여 이전 세대 대비 2배 빠른 프리필(prefill) 속도를 구현했습니다.
성능 및 지원:
- E4B 모델은 10B 미만 모델 중 최초로 LMArena 점수 1300점을 돌파했습니다.
- 텍스트 기준 140개 언어, 멀티모달 상호작용 기준 35개 언어를 지원합니다.
이 요약은 원문 이해를 돕기 위한 큐레이션입니다. 저작권은 원저작자에게 있으며, 정확한 내용과 맥락은 원문을 확인하세요.
요약 오류, 출처 표기 문제, 삭제 요청은 문의 · 건의로 알려주세요.