DeepSeek-V4-Flash-0731: Pro보다 높은 점수, 82.7점의 Flash
deepseek-ai/DeepSeek-V4-Flash-0731
프로젝트 소개
DeepSeek-V4-Flash-0731은 기존 프리뷰 버전을 대체하는 공식 릴리스로, 에이전트 기능이 크게 강화된 텍스트 생성 모델이다. DeepSeek-V4-Flash-DSpark와 동일한 구조를 가지며, 추론 속도를 높이는 스펙ulative decoding 모듈이 내장되어 있다. MIT 라이선스로 공개되어 있어 상업적 활용이 가능하다.
활성화 파라미터 수가 훨씬 적음에도 불구하고 DeepSeek-V4-Pro(Preview)보다 높은 벤치마크 점수를 기록한다. Terminal Bench 2.1에서 82.7점, DeepSWE에서 54.4점을 획득했으며, 이는 GLM-5.2나 Opus-4.8 등 최상위 프로프라이어터리 모델과도 경쟁 가능한 수준이다. 특히 코드 에이전트 및 도구 호출 작업에서 두드러진 성능을 보인다.
Jinja 기반 챗 템플릿 대신 OpenAI 호환 포맷으로 메시지를 인코딩하는 전용 Python 스크립트를 제공한다. reasoning_effort 파라미터를 low, high, max 세 단계로 설정해 답변 전 모델이 할애하는 추론 시간을 직접 조절할 수 있다. vLLM, SGLang, Transformers 등 주요 추론 프레임워크와 호환되며, 8-bit 및 FP8 정밀도 옵션을 지원한다.
복잡한 코드베이스를 이해하거나 자동화 작업을 수행하는 에이전트 개발에 적합하다. 높은 추론 정확도가 필요한 상황에서 비용 효율성을 확보해야 하는 개발자에게 유용하다. DeepSeek Harness와 같은 에이전트 프레임워크와 결합해 최대 추론 노력(max reasoning effort)으로 실행할 때 최적의 성능을 낸다.
deepseek-ai/DeepSeek-V4-Flash-0731
원문에 등록된 설명이 없습니다.
text-generation
이 한국어 소개글은 AI가 자동으로 만들었습니다. 원문의 주장과 맥락은 원문에서 확인해 주세요. 저작권은 원저작자에게 있습니다.