DeepSeek V4 - 프런티어급에 거의 근접했고 가격은 훨씬 저렴하다
·2026.05.03 02:34
핵심 내용
DeepSeek가 V4-Pro와 V4-Flash 프리뷰를 공개하며 가격 경쟁력을 강조했다.
자세히 보기
DeepSeek가 V4-Pro와 V4-Flash 프리뷰 모델을 공개했다. 두 모델은 모두 100만 토큰 컨텍스트를 지원하는 MoE이며, MIT 라이선스로 배포된다.
- V4-Pro: 총 1.6T 파라미터, 활성 49B
- V4-Flash: 총 284B 파라미터, 활성 13B
- Hugging Face 기준 크기: Pro 865GB, Flash 160GB
- V4-Pro는 Kimi K2.6, GLM-5.1, DeepSeek V3.2보다 큰 규모로, 새로운 최대 오픈 가중치 모델로 보인다.
가격은 이번 릴리스의 핵심이다. Flash는 입력 100만 토큰당 $0.14, 출력 $0.28, Pro는 입력 $1.74, 출력 $3.48로 책정됐다. Flash는 소형 모델군에서, Pro는 대형 프런티어 모델군에서 가장 저렴한 축에 들어간다.
긴 컨텍스트 효율도 크게 개선됐다. 100만 토큰 기준으로 Pro는 V3.2 대비 단일 토큰 FLOPs가 27%, KV 캐시가 10% 수준이고, Flash는 FLOPs 10%, KV 캐시 7% 수준까지 내려간다.
자체 벤치마크에서는 Pro가 프런티어 모델과 경쟁 가능한 수준이지만, GPT-5.4와 Gemini-3.1-Pro보다는 약간 낮다. 논문은 추론 토큰 확장판 V4-Pro-Max가 일부 표준 추론 벤치마크에서 GPT-5.2와 Gemini-3.0-Pro를 앞선다고 제시한다.
가격과 효율을 동시에 끌어올린 오픈 가중치 업데이트로 요약된다.
이 한국어 요약은 AI가 자동으로 만들었습니다. 원문의 주장과 맥락은 원문에서 확인해 주세요. 저작권은 원저작자에게 있습니다.