AI Briefing

Qwen2-Math 소개

·2024.08.08 01:00

Qwen이 수학 문제 해결 능력을 극대화한 수학 특화 LLM 시리즈인 Qwen2-Math를 공개했다.

Qwen 시리즈의 새로운 수학 특화 LLM인 Qwen2-MathQwen2-Math-Instruct(1.5B, 7B, 72B)가 공개되었다. 이 모델들은 기존 오픈소스 모델은 물론 GPT-4o, Claude-3.5-Sonnet, Gemini-1.5-Pro, Llama-3.1-405B 등 주요 폐쇄형 모델의 수학 성능을 상회하는 결과를 보여준다.

Qwen2-Math 기본 모델은 Qwen2를 기반으로 수학 전용 코퍼스(웹 텍스트, 도서, 코드, 시험 문제 및 합성 데이터)를 통해 사전 학습되었다. GSM8K, Math, MMLU-STEM 등 주요 영어 벤치마크와 CMATH, GaoKao 등 중국어 벤치마크에서 뛰어난 성능을 입증했다.

Qwen2-Math-Instruct 모델은 수학 특화 보상 모델(Reward Model)을 활용해 성능을 한층 더 끌어올렸다.

  • **거부 샘플링(Rejection Sampling)**과 GRPO(Group Relative Policy Optimization)를 통한 강화 학습 적용
  • AIME 2024, AMC 2023과 같은 고난도 수학 경시 대회 문제에서도 우수한 성능 발휘
  • 동일 규모 모델 대비 최상위권 성능 달성

현재 이 모델은 주로 영어를 지원하며, 향후 영어와 중국어를 모두 지원하는 이중 언어 수학 모델이 출시될 예정이다.

이 요약은 원문 이해를 돕기 위한 큐레이션입니다. 저작권은 원저작자에게 있으며, 정확한 내용과 맥락은 원문을 확인하세요.

요약 오류, 출처 표기 문제, 삭제 요청은 문의 · 건의로 알려주세요.