Ling-3.0-tiny 공개
inclusionAI/Ling-3.0-tiny · 8B A1.3B MoE· Hugging Face
·2026.08.11 02:11
핵심 내용
inclusionAI가 활성 파라미터 1.3B의 8B MoE 모델을 공개했다.
자세히 보기
inclusionAI가 Ling-3.0-tiny를 Hugging Face에 공개했다. 전체 파라미터는 8B, 추론 시 활성화되는 파라미터는 1.3B인 소형 MoE 모델이다.
모델 카드에 따르면 FP8 기준 성능은 다음과 같다.
- DGX Spark: 약 100~105 tokens/s
- M4 Pro MacBook: 약 86~90 tokens/s
- 8K 컨텍스트에서 피크 메모리 사용량: 약 8.34 GiB
Ling-3.0-tiny는 대규모 모델보다 낮은 활성 파라미터로 높은 추론 처리량을 겨냥해 로컬 및 엣지 환경에서의 활용 가능성을 보여준다.
이 한국어 요약은 AI가 자동으로 만들었습니다. 원문의 주장과 맥락은 원문에서 확인해 주세요. 저작권은 원저작자에게 있습니다.