AI Briefing

DeepSeek-V4.1-Flash: 552B 파라미터, 토큰당 890바이트로 KV 캐시 압축

deepseek-ai/DeepSeek-V4.1-Flash

·2026.09.10 17:36

552B 백본 파라미터를 가진 멀티모달 MoE 모델이 1M 토큰 컨텍스트를 지원한다. 텍스트와 이미지를 동시에 입력받아 텍스트를 생성하며, 사전 학습에 45T 토큰을 사용했다.

Causal Encoder-Decoder 구조와 CSA2 기법을 적용해 전역 KV 캐시를 토큰당 890바이트로 줄였다. 이는 이전 세대 대비 약 4분의 1 수준으로, 입력이 많은 에이전트 작업에서 비용 효율을 높인다.

추론 시 활성화되는 파라미터는 프리필 단계 8B, 디코드 단계 16B에 불과하다. 1부터 100까지 조절 가능한 추론 강도 설정을 통해 정확도와 연산 비용 사이의 균형을 직접 제어할 수 있다.

HuggingFace
HuggingFace 모델

deepseek-ai/DeepSeek-V4.1-Flash

원문에 등록된 설명이 없습니다.

image-text-to-text

이 한국어 소개글은 AI가 자동으로 만들었습니다. 원문의 주장과 맥락은 원문에서 확인해 주세요. 저작권은 원저작자에게 있습니다.

AI 처리 방식을 확인하거나, 소개 오류와 출처 표기 문제, 삭제 요청을 문의 · 건의로 알려주세요.