뉴스 250821
핵심 내용
DeepSeek-V3.1이 Think/Non-Think 하이브리드 추론과 에이전트 기능을 공개했다.
1 / 2
자세히 보기
DeepSeek-V3.1이 에이전트 시대를 향한 첫 단계로 공개됐다. 하나의 모델에서 Think와 Non-Think 두 모드를 오가는 하이브리드 추론이 핵심이다.
- DeepSeek-V3.1-Think는 DeepSeek-R1-0528보다 더 짧은 시간에 답을 내도록 개선됐다.
- 후처리 학습으로 도구 사용과 멀티스텝 에이전트 작업 성능도 강화됐다.
- Chat 화면의 DeepThink 버튼으로 Think/Non-Think를 전환해 사용할 수 있다.
API도 함께 업데이트됐다. deepseek-chat은 non-thinking 모드, deepseek-reasoner는 thinking 모드로 연결되며, 둘 다 128K 컨텍스트를 지원한다. 또한 Anthropic API format 지원과 Strict Function Calling 베타 지원이 추가됐다.
모델 쪽에서는 V3.1 Base가 공개됐고, 840B tokens의 continued pretraining으로 긴 컨텍스트 확장을 진행했다. 토크나이저와 chat template도 갱신됐으며, 오픈소스 가중치와 Base 버전 가중치가 각각 제공된다.
가격 정책도 예고됐다. 2025년 9월 5일 16:00 UTC부터 새 요금제가 적용되고 오프피크 할인은 종료되며, 그 전까지는 기존 가격이 유지된다.
이 한국어 요약은 AI가 자동으로 만들었습니다. 원문의 주장과 맥락은 원문에서 확인해 주세요. 저작권은 원저작자에게 있습니다.