AI Briefing

Qwen2-Math 소개

·2024.08.08 01:00

핵심 내용

Qwen이 수학 문제 해결 능력을 극대화한 수학 특화 LLM 시리즈인 Qwen2-Math를 공개했다.

1 / 2

자세히 보기

Qwen 시리즈의 새로운 수학 특화 LLM인 Qwen2-Math와 Qwen2-Math-Instruct(1.5B, 7B, 72B)가 공개되었다. 이 모델들은 기존 오픈소스 모델은 물론 GPT-4o, Claude-3.5-Sonnet, Gemini-1.5-Pro, Llama-3.1-405B 등 주요 폐쇄형 모델의 수학 성능을 상회하는 결과를 보여준다.

Qwen2-Math 기본 모델은 Qwen2를 기반으로 수학 전용 코퍼스(웹 텍스트, 도서, 코드, 시험 문제 및 합성 데이터)를 통해 사전 학습되었다. GSM8K, Math, MMLU-STEM 등 주요 영어 벤치마크와 CMATH, GaoKao 등 중국어 벤치마크에서 뛰어난 성능을 입증했다.

Qwen2-Math-Instruct 모델은 수학 특화 보상 모델(Reward Model)을 활용해 성능을 한층 더 끌어올렸다.

  • **거부 샘플링(Rejection Sampling)**과 GRPO(Group Relative Policy Optimization)를 통한 강화 학습 적용
  • AIME 2024, AMC 2023과 같은 고난도 수학 경시 대회 문제에서도 우수한 성능 발휘
  • 동일 규모 모델 대비 최상위권 성능 달성

현재 이 모델은 주로 영어를 지원하며, 향후 영어와 중국어를 모두 지원하는 이중 언어 수학 모델이 출시될 예정이다.

이 한국어 요약은 AI가 자동으로 만들었습니다. 원문의 주장과 맥락은 원문에서 확인해 주세요. 저작권은 원저작자에게 있습니다.

AI 처리 방식을 확인하거나, 요약 오류와 출처 표기 문제, 삭제 요청을 문의 · 건의로 알려주세요.