AI Briefing

DeepSeek V4 - 프런티어급에 거의 근접했고 가격은 훨씬 저렴하다

·2026.05.03 02:34

DeepSeek가 V4-Pro와 V4-Flash 프리뷰를 공개하며 가격 경쟁력을 강조했다.

DeepSeek가 V4-ProV4-Flash 프리뷰 모델을 공개했다. 두 모델은 모두 100만 토큰 컨텍스트를 지원하는 MoE이며, MIT 라이선스로 배포된다.

  • V4-Pro: 총 1.6T 파라미터, 활성 49B
  • V4-Flash: 총 284B 파라미터, 활성 13B
  • Hugging Face 기준 크기: Pro 865GB, Flash 160GB
  • V4-Pro는 Kimi K2.6, GLM-5.1, DeepSeek V3.2보다 큰 규모로, 새로운 최대 오픈 가중치 모델로 보인다.

가격은 이번 릴리스의 핵심이다. Flash는 입력 100만 토큰당 $0.14, 출력 $0.28, Pro는 입력 $1.74, 출력 $3.48로 책정됐다. Flash는 소형 모델군에서, Pro는 대형 프런티어 모델군에서 가장 저렴한 축에 들어간다.

긴 컨텍스트 효율도 크게 개선됐다. 100만 토큰 기준으로 Pro는 V3.2 대비 단일 토큰 FLOPs가 27%, KV 캐시가 10% 수준이고, Flash는 FLOPs 10%, KV 캐시 7% 수준까지 내려간다.

자체 벤치마크에서는 Pro가 프런티어 모델과 경쟁 가능한 수준이지만, GPT-5.4Gemini-3.1-Pro보다는 약간 낮다. 논문은 추론 토큰 확장판 V4-Pro-Max가 일부 표준 추론 벤치마크에서 GPT-5.2Gemini-3.0-Pro를 앞선다고 제시한다.

가격과 효율을 동시에 끌어올린 오픈 가중치 업데이트로 요약된다.

이 요약은 원문 이해를 돕기 위한 큐레이션입니다. 저작권은 원저작자에게 있으며, 정확한 내용과 맥락은 원문을 확인하세요.

요약 오류, 출처 표기 문제, 삭제 요청은 문의 · 건의로 알려주세요.