AI Briefing

해시 검증으로 확인된 Qwen3.8-Flash-Next 편집 모델

A file-by-file hash check of one uncensored Qwen3.8-Flash-Next upload against Qwen's original, from "Uncensored models: what they are and how they work"

·2026.10.06 07:48

핵심 내용

해시 검증 결과 OrcaRouter의 Qwen 모델은 전체 파인튜닝이 아닌 타겟 편집 방식이 적용된 것으로 확인됐다.

자세히 보기

OrcaRouter의 Qwen3.8-Flash-Next-Uncensored-GGUF 업로드 파일과 Qwen 원본 가중치를 파일별 해시로 비교한 결과, 131개 가중치 파일 중 80개가 바이트 단위로 동일했다. 나머지 51개 파일은 모델 카드에서 편집된 것으로 명시된 행렬을 포함하고 있어, 전체 파인튜닝이나 모델 병합이 아닌 abliteration(타겟 편집) 방식이 적용된 것으로 확인됐다.

검증 방법론

Hugging Face의 SHA256 해시를 활용해 업로드된 전체 정밀도 사본과 고정된 리비전의 Qwen 원본을 비교했다. 주요 발견 사항은 다음과 같다:

  • 51개 파일은 내용이 다르지만 크기는 동일하다.
  • 각 상이한 파일은 모델 카드에 편집 대상으로 명시된 149개 행렬 중 최소 하나를 포함한다.
  • 변경되지 않은 80개 파일에는 편집된 행렬이 전혀 없다.
  • 173개 텐서, 즉 모델 파일 바이트의 **72.6%**가 변경되지 않았음을 입증했다.

성능 및 한계

해시 검증은 구조적 변경을 확인했지만, 편집의 구체적인 성격을 드러내지는 않는다. 업로더는 thinking 비활성화 상태에서 XSTest의 무해한 프롬프트 250개에 대한 거부율이 **9.6%**에서 **1.2%**로 감소했다고 보고했다. 능력 점수는 일반적으로 원본 대비 2.3점 이내로 유지됐으나, MMLU 300개 질문에서는 2.3점 하락했다. 이러한 수치는 분석가가 모델을 실행하지 않아 재현되지 않았다.

메타데이터 불일치

업로드 메타데이터에서 이상 현상이 발견됐다. 메타데이터는 Qwen을 직접적인 기본 모델로 지칭하는 반면, 모델 카드는 편집된 부모 모델을 명시한다. 이 불일치로 인해 Hugging Face의 모델 트리에서 계보 표시 시 한 세대가 건너뛰어진다.

이 한국어 요약은 AI가 자동으로 만들었습니다. 원문의 주장과 맥락은 원문에서 확인해 주세요. 저작권은 원저작자에게 있습니다.

AI 처리 방식을 확인하거나, 요약 오류와 출처 표기 문제, 삭제 요청을 문의 · 건의로 알려주세요.