추천
DeepSeek, V4.1-Flash 공개... V4-Pro보다 성능 우위 및 가격 인하
·2026.09.10 09:00
핵심 내용
DeepSeek가 V4-Pro보다 성능과 효율성이 뛰어난 V4.1-Flash를 공개하고 API 가격을 인하했다.
1 / 5
자세히 보기
DeepSeek가 새로운 아키텍처 계열 중 가장 작은 모델인 DeepSeek-V4.1-Flash를 출시했다. 이 모델은 네이티브 시각 이해 기능을 탑재했으며, 더 높은 성능과 빠른 추론 속도를 목표로 설계되었다.
비대칭 아키텍처와 효율성
V4.1-Flash는 총 552B 파라미터의 MoE(Mixture of Experts) 모델로, 새로운 Causal Encoder–Decoder 구조를 채택했다. 입력 시에는 8B, 출력 시에는 16B의 활성 파라미터만 사용하여 효율성을 극대화했다. 이를 통해 이전 세대 대비 HBM 사용량은 1/4, SSD 저장 공간은 1/8로 감소시켰으며, 에이전트 비용의 주요 부분인 Cache-hit 비용을 대폭 절감했다.
V4-Pro 대체 및 가격 정책
다수 기관의 테스트 결과, V4.1-Flash는 플래그십 모델인 V4-Pro보다 성능, 비용, 속도, 총 실행 시간에서 우위를 보였다. 이에 따라 V4-Pro는 단계적으로 폐기될 예정이며, 2026년 9월 14일부터 모든 V4-Pro 요청은 V4.1-Flash로 라우팅된다. DeepSeek은 아키텍처 효율화로 인한 비용 절감을 사용자에게 환원하기 위해 API 가격을 인하했으며, Peak 요금의 50%인 Off-peak 요금제를 유지한다.
이 한국어 요약은 AI가 자동으로 만들었습니다. 원문의 주장과 맥락은 원문에서 확인해 주세요. 저작권은 원저작자에게 있습니다.