DeepSeek-V4.1-Flash-UNCENSORED-FP8: HarmBench 100% 통과, 안전장치 제거된 DeepSeek-V4.1
dealignai/DeepSeek-V4.1-Flash-UNCENSORED-FP8
·2026.09.15 05:42
프로젝트 소개
DeepSeek-V4.1-Flash의 가중치에서 안전 필터를 영구적으로 제거한 변형 모델이다. 기존 모델이 논리적 추론 과정에서 안전성을 우선시해 답변을 거부하는 현상을 해결하기 위해, 거부 회로를 정밀하게 제거하면서도 원본의 성능을 유지하도록 설계됐다.

HarmBench 평가에서 모든 항목에 대해 100% 응답률을 기록했으며, 이는 기존 모델이 추론 강도를 높일수록 거부율이 상승하는 것과 대조적이다. MMLU 벤치마크에서는 약 4.2%의 성능 저하가 있었으나, 윤리 관련 질문을 제외하면 원본과 유사한 지식을 유지한다.
1M 토큰의 긴 컨텍스트와 비전 입력을 지원하며, FP8 양자화로 배포 편의성을 높였다. vLLM이나 SGLang 등 주요 추론 엔진과 호환되므로, 자체 서버에서 무제한 생성이 필요한 환경에 즉시 적용할 수 있다.
HuggingFace 모델
dealignai/DeepSeek-V4.1-Flash-UNCENSORED-FP8
원문에 등록된 설명이 없습니다.
image-text-to-text
이 한국어 소개글은 AI가 자동으로 만들었습니다. 원문의 주장과 맥락은 원문에서 확인해 주세요. 저작권은 원저작자에게 있습니다.