AI Briefing

GPT-4o mini: 비용 효율적인 지능의 진화

·2024.07.18 19:00

OpenAI가 GPT-3.5 Turbo보다 60% 이상 저렴하고 성능은 강화된 소형 모델 **GPT-4o mini**를 공개했다.

OpenAI가 가장 비용 효율적인 소형 모델인 GPT-4o mini를 발표했다. 이 모델은 100만 토큰당 입력 15센트, 출력 60센트로 책정되어 기존 프론티어 모델보다 훨씬 저렴하며, GPT-3.5 Turbo 대비 60% 이상의 비용 절감 효과를 제공한다.

GPT-4o mini는 낮은 비용과 낮은 지연 시간(latency)을 바탕으로 다중 API 호출, 대규모 컨텍스트 전달, 실시간 고객 지원 챗봇 등 다양한 애플리케이션에 최적화되어 있다. 현재 API를 통해 텍스트와 비전을 지원하며, 향후 오디오와 비디오 입력 및 출력 기능도 추가될 예정이다.

주요 성능 지표는 다음과 같다:

  • MMLU (추론): 82.0%를 기록하며 Gemini Flash(77.9%)와 Claude Haiku(73.8%)를 앞섰다.
  • MGSM (수학): 87.0%로 Gemini Flash(75.5%) 대비 우수한 성능을 보였다.
  • HumanEval (코딩): 87.2%를 달성하여 기존 소형 모델들을 압도한다.
  • MMMU (멀티모달 추론): 59.4%를 기록했다.

모델은 128K 컨텍스트 윈도우와 최대 16K 출력 토큰을 지원하며, 2023년 10월까지의 지식을 보유하고 있다. 또한 개선된 토크나이저를 통해 비영어권 언어 처리의 비용 효율성도 높였다.

이 요약은 원문 이해를 돕기 위한 큐레이션입니다. 저작권은 원저작자에게 있으며, 정확한 내용과 맥락은 원문을 확인하세요.

요약 오류, 출처 표기 문제, 삭제 요청은 문의 · 건의로 알려주세요.