OpenAI, EU AI Act 대응 위해 텍스트 워터마킹 도입… API 전역 옵트인 및 EU 대상 적용
핵심 내용
OpenAI, EU AI Act 대응 위해 API 전역 옵트인 및 EU 대상 텍스트 워터마킹 도입했다.
자세히 보기
OpenAI가 EU AI Act 준수를 위해 텍스트 워터마킹 도입을 단계적으로 추진한다. 생성형 AI 제공업체는 기계가 읽을 수 있는 방식으로 생성 텍스트를 식별 가능하게 해야 한다. OpenAI는 텍스트 워터마킹이 아직 초기 기술이며 한계가 있음을 강조하며, 신호가 무엇을 확인하고 무엇을 확인하지 못하는지에 대한 투명성을 우선시한다.
단계적 배포 전략
규제 요구사항과 기술적 제약 사이의 균형을 맞추기 위한 3단계 계획을 따른다.
- API 고객: 오늘부터 전 세계 API 고객은 특정 모델에 대해 텍스트 워터마킹을 옵트인할 수 있다. 이 기능은 기본적으로 꺼져 있다.
- EU 사용자: 향후 몇 주 동안 유럽 연합 사용자의 ChatGPT 및 Codex 텍스트 출력에 보이지 않는 워터마킹이 추가된다.
- 탐지 도구 접근: 승인된 연구자와 전문가 조직이 텍스트 워터마킹 탐지기에 접근할 수 있도록 신청을 받는다. 결과 오해를 방지하기 위해 일반 대중의 접근은 제한된다.
기술 및 성능 한계
OpenAI의 워터마킹 기술인 textGrain은 모델의 단어 선택에 보이지 않는 통계적 신호를 추가한다. 평가 결과 textGrain은 SynthID for text 등 다른 접근 방식과 동등하거나 이를 능가했지만, 실제 신뢰도는 텍스트 길이와 편집 여부에 따라 크게 달라진다.
- 텍스트 길이 영향: 1% 오탐율 기준, 일반 콘텐츠에서 200토큰 구간의 약 80%, 400토큰 구간의 약 **95%**에서 워터마킹이 탐지되었다. 단어 선택 유연성이 제한된 수학 분야에서는 탐지율이 현저히 낮았다.
- 편집 취약성: 단어의 **10%**를 유의어로 교체하면 탐지율이 약 **92%**에서 **66%**로 감소했다. **25%**를 교체하면 탐지율은 **17%**까지 떨어졌다.
모델 품질 영향
OpenAI의 최신 프런티어 모델인 Astra 벤치마크 결과, 워터마킹 적용 여부에 따른 의미 있는 성능 차이는 없었다. Artificial Analysis Intelligence Index(49.57 vs 49.76점) 및 GPQA Diamond(94.44% vs 93.94%) 등 주요 지표는 테스트 전반에서 안정적으로 유지되었다.
범위 및 해석
OpenAI는 텍스트 워터마킹이 제한적인 신호일 뿐이며 소유권 확립, 정확성 검증, 사용자 식별을 하지 못한다고 명확히 한다. 워터마킹이 탐지되지 않는다고 해서 인간이 작성한 것이라고 증명할 수 없으며, 텍스트가 너무 짧거나 편집되었거나 지원되지 않는 모델로 생성되었을 수 있다. 회사는 이 기술을 오픈소스로 공개하고 표준과 증거가 진화함에 따라 접근 방식을 재검토할 계획이다.
이 한국어 요약은 AI가 자동으로 만들었습니다. 원문의 주장과 맥락은 원문에서 확인해 주세요. 저작권은 원저작자에게 있습니다.