AI Briefing

Ling-3.0-tiny 공개

inclusionAI/Ling-3.0-tiny · 8B A1.3B MoE· Hugging Face

·2026.08.11 02:11

핵심 내용

inclusionAI가 활성 파라미터 1.3B의 8B MoE 모델을 공개했다.

자세히 보기

inclusionAI가 Ling-3.0-tiny를 Hugging Face에 공개했다. 전체 파라미터는 8B, 추론 시 활성화되는 파라미터는 1.3B인 소형 MoE 모델이다.

모델 카드에 따르면 FP8 기준 성능은 다음과 같다.

  • DGX Spark: 약 100~105 tokens/s
  • M4 Pro MacBook: 약 86~90 tokens/s
  • 8K 컨텍스트에서 피크 메모리 사용량: 약 8.34 GiB

Ling-3.0-tiny는 대규모 모델보다 낮은 활성 파라미터로 높은 추론 처리량을 겨냥해 로컬 및 엣지 환경에서의 활용 가능성을 보여준다.

이 한국어 요약은 AI가 자동으로 만들었습니다. 원문의 주장과 맥락은 원문에서 확인해 주세요. 저작권은 원저작자에게 있습니다.

AI 처리 방식을 확인하거나, 요약 오류와 출처 표기 문제, 삭제 요청을 문의 · 건의로 알려주세요.