AI Briefing
추천

Qwen3.8 2.4T 공개

Qwen3.8-2.4T-A95B 오픈 웨이트 공개

·2026.08.13 06:33

핵심 내용

Qwen이 총 2.4T, 활성 95B 규모의 Qwen3.8 오픈 모델을 공개했다.

자세히 보기

Qwen이 오픈 모델 제품군의 최상위 세대인 Qwen3.8-2.4T-A95B의 가중치와 설정 파일을 Hugging Face Transformers 형식으로 공개했다.

  • 총 파라미터: 2.4T
  • 활성 파라미터: 95B
  • 구조: 512개 Expert 중 10개 Routed Expert와 1개 Shared Expert를 활성화하는 MoE
  • 컨텍스트 길이: 기본 262K 토큰, 최대 약 1.01M 토큰까지 확장 가능
  • 지원 환경: Transformers, vLLM, SGLang, TokenSpeed 등

Qwen3.8은 코딩, 전문 업무, 연구, 장기 에이전트 작업을 개선했으며, reasoning_effort로 추론 깊이를 조절하고 preserve_thinking으로 대화 기록의 추론 컨텍스트를 유지한다.

모델 카드가 제시한 평가에서 PaperBench 93.0, IFBench 82.8, MRCR v2 256K 92.9 등의 점수를 기록했으며, 코딩 에이전트·업무 자동화·도구 사용 성능도 함께 비교했다. 비전 입력, 비사고 모드, 기본 1M 컨텍스트와 공식 도구를 제공하는 관리형 버전은 Qwen3.8-Max로 별도 제공된다.

이 한국어 요약은 AI가 자동으로 만들었습니다. 원문의 주장과 맥락은 원문에서 확인해 주세요. 저작권은 원저작자에게 있습니다.

AI 처리 방식을 확인하거나, 요약 오류와 출처 표기 문제, 삭제 요청을 문의 · 건의로 알려주세요.