AI Briefing

OpenAI, Moonshot AI 연계 모델 증류 캠페인 차단

·2026.09.30 19:30

핵심 내용

OpenAI가 Moonshot AI와 연계된 모델 증류 캠페인을 차단했다.

자세히 보기

OpenAI가 자사 모델의 보호된 추론 데이터를 추출하려는 조직적인 캠페인을 식별하고 차단했다. 최초 활동은 7월 첫 주에 관측되었으며, 이는 다른 모델을 훈련하거나 개선하기 위해 내부 추론을 무단으로 사용하는 적대적 증류(adversarial distillation)에 해당한다.

운영자들은 암호화를 뚫거나 데이터베이스에 직접 접근하지 않았다. 대신 모델과의 상호작용을 조작해 보호된 추론을 가시적인 형태로 재현했으며, 이는 서비스 약관 위반이다. 이 기법은 OpenAI에만 국한되지 않으며, 회사는 Frontier Model Forum을 통해 업계 파트너와 조사 결과를 공유해 공동 방어 체계를 강화하고 있다.

범위 및 귀속

활동은 7월 1일 저조한 수준에서 시작해 7월 24일과 25일에 고빈도 급증으로 이어졌다. 이 급증은 4,000명 이상의 사용자가 추출 패턴을 이용해 보낸 16,000건의 요청으로 구성됐다. 추가 조사 결과, 15,000명 이상의 사용자 클러스터에서 관련 프롬프트 패턴 활동이 드러났으며, 해당 활동은 7월 28일부로 완전히 차단됐다.

모든 운영자가 단일 행위자로부터 비롯됐는지는 불분명하지만, OpenAI는 활동의 핵심 클러스터를 Kimi 개발사인 Moonshot AI와 연관된 개인들에게 귀속했다. 독립 보안 연구자들도 관련 교차 모델 및 대화 압축 취약점을 보고했으며, OpenAI는 이를 확인하고 완화 조치를 가속화하는 데 활용했다.

대응 및 향후 방어

OpenAI는 사기 계정 금지, 가입 통제 강화, 모니터링 확대 등으로 대응했다. 기술적 완화 조치로는 암호화된 추론 재생을 허용하던 경로 차단과 숨겨진 추론을 노출하는 스트리밍 출력 감지 검사 추가가 포함됐다. 또한 제3자 서비스 제공업체와 협력해 관련 계정을 차단했다.

회사는 프런티어 모델이 발전함에 따라 적대적 증류 시도가 더욱 정교해질 것으로 예상한다. 향후 노력은 더 강력한 기술적 보호, 조직적 캠페인 탐지 개선, 그리고 산업 및 정부 간 심층적인 위협 정보 공유에 집중될 것이다. 파트너 호스팅 배포와 도구 출력 공격은 방어 강화를 위해 계속 주시해야 할 주요 영역으로 남아 있다.

이 한국어 요약은 AI가 자동으로 만들었습니다. 원문의 주장과 맥락은 원문에서 확인해 주세요. 저작권은 원저작자에게 있습니다.

AI 처리 방식을 확인하거나, 요약 오류와 출처 표기 문제, 삭제 요청을 문의 · 건의로 알려주세요.