AI Briefing

Meta, 멀티모달 안전 모델 Llama Guard 4 공개

Welcoming Llama Guard 4 on Hugging Face Hub

·2025.04.29 09:00

핵심 내용

Meta가 텍스트와 이미지를 모두 검사하는 12B 규모의 멀티모달 안전 모델 Llama Guard 4를 출시했다.

자세히 보기

Llama Guard 4는 텍스트와 이미지를 모두 분석하여 부적절한 콘텐츠를 탐지하는 12B 규모의 밀집(dense) 멀티모달 모델이다. Llama 4 Scout 모델에서 MoE(Mixture-of-Experts) 레이어를 제거하고 공유 전문가 가중치만을 활용해 최적화되었으며, 24GB VRAM을 갖춘 단일 GPU에서 실행 가능하다.

이 모델은 MLCommons 분류 체계에 기반한 14가지 위험 유형(폭력, 성적 콘텐츠, 개인정보 침해, 선거 관련 등)과 코드 인터프리터 남용을 식별할 수 있다. 이전 모델인 Llama Guard 3와 비교해 영어 및 멀티모달 환경에서 성능이 크게 향상되었으며 다국어 지원도 가능하다.

또한, 프롬프트 주입 및 탈옥(jailbreak) 탐지에 특화된 Llama Prompt Guard 2 시리즈(86M, 22M 파라미터)도 함께 공개되어 더욱 강력한 보안 파이프라인 구축이 가능해졌다.

이 한국어 요약은 AI가 자동으로 만들었습니다. 원문의 주장과 맥락은 원문에서 확인해 주세요. 저작권은 원저작자에게 있습니다.

AI 처리 방식을 확인하거나, 요약 오류와 출처 표기 문제, 삭제 요청을 문의 · 건의로 알려주세요.