AI Briefing

뉴스 250821

DeepSeek-V3.1이 Think/Non-Think 하이브리드 추론과 에이전트 기능을 공개했다.

DeepSeek-V3.1이 에이전트 시대를 향한 첫 단계로 공개됐다. 하나의 모델에서 ThinkNon-Think 두 모드를 오가는 하이브리드 추론이 핵심이다.

  • DeepSeek-V3.1-ThinkDeepSeek-R1-0528보다 더 짧은 시간에 답을 내도록 개선됐다.
  • 후처리 학습으로 도구 사용멀티스텝 에이전트 작업 성능도 강화됐다.
  • Chat 화면의 DeepThink 버튼으로 Think/Non-Think를 전환해 사용할 수 있다.

API도 함께 업데이트됐다. deepseek-chat은 non-thinking 모드, deepseek-reasoner는 thinking 모드로 연결되며, 둘 다 128K 컨텍스트를 지원한다. 또한 Anthropic API format 지원과 Strict Function Calling 베타 지원이 추가됐다.

모델 쪽에서는 V3.1 Base가 공개됐고, 840B tokens의 continued pretraining으로 긴 컨텍스트 확장을 진행했다. 토크나이저와 chat template도 갱신됐으며, 오픈소스 가중치와 Base 버전 가중치가 각각 제공된다.

가격 정책도 예고됐다. 2025년 9월 5일 16:00 UTC부터 새 요금제가 적용되고 오프피크 할인은 종료되며, 그 전까지는 기존 가격이 유지된다.

이 요약은 원문 이해를 돕기 위한 큐레이션입니다. 저작권은 원저작자에게 있으며, 정확한 내용과 맥락은 원문을 확인하세요.

요약 오류, 출처 표기 문제, 삭제 요청은 문의 · 건의로 알려주세요.