AI Briefing
추천

DeepSeek, V4.1-Flash 공개... V4-Pro보다 성능 우위 및 가격 인하

·2026.09.10 09:00

핵심 내용

DeepSeek가 V4-Pro보다 성능과 효율성이 뛰어난 V4.1-Flash를 공개하고 API 가격을 인하했다.

1 / 5

자세히 보기

DeepSeek가 새로운 아키텍처 계열 중 가장 작은 모델인 DeepSeek-V4.1-Flash를 출시했다. 이 모델은 네이티브 시각 이해 기능을 탑재했으며, 더 높은 성능과 빠른 추론 속도를 목표로 설계되었다.

비대칭 아키텍처와 효율성

V4.1-Flash는 총 552B 파라미터의 MoE(Mixture of Experts) 모델로, 새로운 Causal Encoder–Decoder 구조를 채택했다. 입력 시에는 8B, 출력 시에는 16B의 활성 파라미터만 사용하여 효율성을 극대화했다. 이를 통해 이전 세대 대비 HBM 사용량은 1/4, SSD 저장 공간은 1/8로 감소시켰으며, 에이전트 비용의 주요 부분인 Cache-hit 비용을 대폭 절감했다.

V4-Pro 대체 및 가격 정책

다수 기관의 테스트 결과, V4.1-Flash는 플래그십 모델인 V4-Pro보다 성능, 비용, 속도, 총 실행 시간에서 우위를 보였다. 이에 따라 V4-Pro는 단계적으로 폐기될 예정이며, 2026년 9월 14일부터 모든 V4-Pro 요청은 V4.1-Flash로 라우팅된다. DeepSeek은 아키텍처 효율화로 인한 비용 절감을 사용자에게 환원하기 위해 API 가격을 인하했으며, Peak 요금의 50%인 Off-peak 요금제를 유지한다.

이 한국어 요약은 AI가 자동으로 만들었습니다. 원문의 주장과 맥락은 원문에서 확인해 주세요. 저작권은 원저작자에게 있습니다.

AI 처리 방식을 확인하거나, 요약 오류와 출처 표기 문제, 삭제 요청을 문의 · 건의로 알려주세요.