AI Briefing

Qwen3.6 핵심옵션

PSA: Qwen3.6 ships with preserve_thinking. Make sure you have it on.

·2026.04.17 04:41

핵심 내용

Qwen3.6에 preserve_thinking이 추가돼 추론 컨텍스트와 KV 캐시 효율을 개선한다.

자세히 보기

Qwen 3.6은 새 preserve_thinking 플래그로 이전 turn의 reasoning을 그대로 유지하도록 바뀌었다.

  • 모델 페이지 안내에 따르면 chat_template_kwargs: {"preserve_thinking": False} 대신 **"preserve_thinking": True**를 사용해야 한다.
  • 이전 버전에서 문제가 됐던 KV cache invalidation과 관련해, reasoning을 재직렬화하지 않고 이어 붙이기 때문에 캐시 재사용이 더 안정적이다.
  • 특히 agent / tool-calling 시나리오에서 유리하다. 모델이 자기 이전 사고 과정을 참조할 수 있어 결정 일관성이 좋아지고, 불필요한 재추론을 줄여 토큰 소비도 줄일 수 있다.
  • 추론 모드와 비추론 모드 모두에서 KV cache utilization을 최적화하는 효과가 있다고 설명한다.

검증 방법도 제시한다.

  1. 모델에게 두 개의 20자리 랜덤 숫자를 생각하고, 도구를 쓰지 말고 하나만 출력하라고 시킨다.
  2. 다음 turn에서 다른 숫자를 보여 달라고 요청한다.
  3. preserve_thinking off면 이전 reasoning을 잃어버려 두 번째 숫자를 기억하지 못하고, on이면 바로 이전 사고를 참조해 두 번째 숫자를 말할 수 있다.

작성자는 이 동작을 통해 설정이 제대로 켜졌는지 확인할 수 있다고 정리한다.

이 한국어 요약은 AI가 자동으로 만들었습니다. 원문의 주장과 맥락은 원문에서 확인해 주세요. 저작권은 원저작자에게 있습니다.

AI 처리 방식을 확인하거나, 요약 오류와 출처 표기 문제, 삭제 요청을 문의 · 건의로 알려주세요.