AI Briefing

Google Gemma 4, iPhone에서 네이티브로 실행되고 완전 오프라인 AI Inference를 지원

·2026.04.15 14:19

핵심 내용

Gemma 4가 iPhone에서 로컬 GPU로 돌아가며 오프라인 추론을 지원한다.

자세히 보기

Google의 Gemma 4가 iPhone에서 직접 실행되며, 인터넷 없이도 로컬 inference를 수행한다.

핵심 포인트는 단순한 데모가 아니라, 모바일 기기에서의 on-device AI가 실제 배포 단계로 들어왔다는 점이다. Google은 Google AI Edge Gallery 앱을 통해 이 모델을 제공하고, 사용자는 App Store에서 앱을 내려받은 뒤 원하는 모델 variant를 선택해 바로 실행할 수 있다.

모델 선택은 성능보다 기기 적합성이 중요하게 다뤄진다.

  • 31B variant는 Qwen 3.5 27B와 비슷한 급으로 언급된다.
  • E2B, E4B는 모바일 배포를 염두에 둔 소형 모델로, 효율성과 경량성을 우선한다.
  • Google 앱은 특히 E2B를 추천하며, 메모리와 발열 제약이 있는 실제 환경에 더 적합하다고 설명한다.

기능도 단순 텍스트 챗봇에 그치지 않는다. 이미지 인식, 음성 상호작용, 확장 가능한 Skills framework를 포함해 on-device AI 실험용 플랫폼에 가깝게 구성됐다.

추론은 iPhone의 GPU를 통해 돌아가며, 응답 지연이 낮아 소비자 하드웨어에서도 이런 종류의 워크로드가 충분히 가능해졌다는 메시지를 준다.

오프라인 동작은 다음 같은 환경에서 특히 의미가 크다.

  • field applications
  • healthcare 환경
  • 데이터 전송이 제한되거나 privacy가 중요한 업무

결국 이 발표의 요지는, 모바일 기기에서의 로컬 AI가 더 이상 먼 미래의 개념이 아니라는 점이다. Google은 Gemma를 통해 iPhone을 포함한 엣지 디바이스에서의 실용적인 inference 기반을 밀고 있다.

이 한국어 요약은 AI가 자동으로 만들었습니다. 원문의 주장과 맥락은 원문에서 확인해 주세요. 저작권은 원저작자에게 있습니다.

AI 처리 방식을 확인하거나, 요약 오류와 출처 표기 문제, 삭제 요청을 문의 · 건의로 알려주세요.