AI Briefing

일반 대화와 코딩 기능을 결합한 새 오픈소스 모델 DeepSeek-V2.5

DeepSeek-V2.5가 일반 대화와 코딩을 합쳐 웹과 API에 공개됐다.

DeepSeek-V2.5DeepSeek-V2-0628DeepSeek-Coder-V2-0724를 결합한 새 오픈소스 모델로, 일반 대화 능력과 코드 처리 능력을 함께 제공한다. 글쓰기와 instruction-following도 개선됐고, 웹과 API에서 모두 사용할 수 있으며 기존과 호환되는 엔드포인트를 유지한다.

접속 방식은 deepseek-coderdeepseek-chat을 그대로 지원한다. Function Calling, FIM completion, JSON output은 변경되지 않았고, 전반적으로 더 간결하고 효율적인 사용 경험을 목표로 한다.

성능 측면에서는 대부분의 벤치마크에서 DeepSeek-V2.5가 두 전작을 앞섰다. 내부 중국 평가에서는 GPT-4o mini와 ChatGPT-4o-latest에 대한 승률도 개선됐으며, 특히 콘텐츠 제작과 Q&A에서 향상이 두드러졌다.

안전성도 조정됐다. 내부 테스트 기준으로 Overall Safety Score는 **74.4%**에서 **82.6%**로 올랐고, Safety Spillover Rate는 **11.3%**에서 **4.6%**로 낮아졌다. jailbreak 방어는 강화하면서도 정상 질의에 대한 과도한 안전 정책 적용은 줄였다고 설명한다.

코딩 영역에서는 HumanEval Python과 **LiveCodeBench (Jan 2024 - Sep 2024)**에서 개선을 보였고, DS-FIM-Eval 내부 테스트에서는 5.1% 향상을 기록했다. 다만 HumanEval Multilingual, Aider, SWE-verified에서는 여전히 개선 여지가 남아 있다고 밝혔다.

  • DS-Arena-Code 내부 평가에서도 경쟁 모델 대비 승률이 크게 상승했다.
  • 성능이 떨어지는 일부 사례에서는 system prompttemperature 조정을 권장했다.
  • 모델은 현재 HuggingFace에서 오픈소스로 공개됐다: https://huggingface.co/deepseek-ai/DeepSeek-V2.5

이 요약은 원문 이해를 돕기 위한 큐레이션입니다. 저작권은 원저작자에게 있으며, 정확한 내용과 맥락은 원문을 확인하세요.

요약 오류, 출처 표기 문제, 삭제 요청은 문의 · 건의로 알려주세요.