DeepSeek-V4 Preview 공개
DeepSeek가 100만 토큰 컨텍스트를 지원하는 고성능 V4 Preview 모델을 오픈소스로 공개했다.
DeepSeek-V4 Preview가 공식 출시되었으며 오픈소스로 공개되었습니다. 이번 업데이트는 100만 토큰의 컨텍스트 길이를 매우 경제적인 비용으로 제공하는 데 초점을 맞췄습니다.
모델은 두 가지 버전으로 제공됩니다:
- DeepSeek-V4-Pro: 총 1.6T, 활성 파라미터 49B 규모로, 세계 최고 수준의 폐쇄형 모델과 경쟁하는 성능을 자랑합니다. 에이전트 코딩 벤치마크에서 SOTA를 기록했으며, 수학 및 STEM 분야에서 강력한 추론 능력을 보여줍니다.
- DeepSeek-V4-Flash: 총 284B, 활성 파라미터 13B 규모로, Pro 모델에 근접한 성능을 유지하면서도 빠른 응답 속도와 높은 비용 효율성을 제공합니다.
기술적으로는 토큰 단위 압축과 **DSA(DeepSeek Sparse Attention)**를 결합한 새로운 어텐션 메커니즘을 도입했습니다. 이를 통해 연산 및 메모리 비용을 획기적으로 줄이면서도 100만 토큰의 긴 컨텍스트를 기본 사양으로 지원합니다.
API는 현재 사용 가능하며 OpenAI ChatCompletions 및 Anthropic API 형식을 지원합니다. 또한 Thinking/Non-Thinking 두 가지 모드를 모두 지원하여 용도에 맞는 최적의 추론 환경을 제공합니다.
이 요약은 원문 이해를 돕기 위한 큐레이션입니다. 저작권은 원저작자에게 있으며, 정확한 내용과 맥락은 원문을 확인하세요.
요약 오류, 출처 표기 문제, 삭제 요청은 문의 · 건의로 알려주세요.