AI Briefing

Google, SynthID Text 공개

Introducing SynthID Text

·2024.10.23 09:00

Google DeepMind와 Hugging Face가 AI 생성 텍스트에 워터마크를 삽입하고 탐지하는 SynthID Text를 출시했다.

Google DeepMind와 Hugging Face가 AI 생성 콘텐츠의 신뢰성을 높이기 위해 텍스트에 워터마크를 삽입하고 탐지하는 SynthID Text를 Transformers v4.46.0 버전에 통합하여 출시했다.

이 기술은 LLM의 생성 품질이나 작동 방식에 영향을 주지 않으면서, 인간은 인지할 수 없지만 훈련된 모델은 식별할 수 있는 워터마크를 생성 과정에 심는다.

주요 기술 및 특징:

  • 작동 원리: 의사 난수 함수(g-function)를 사용하여 생성 과정에 워터마크를 인코딩한다.
  • 범용성: 모델의 수정 없이 model.generate() API를 통해 모든 LLM과 호환되는 logits processor 형태로 제공된다.
  • 탐지: 전용 분류기(classifier)를 통해 워터마크가 삽입된 텍스트를 식별할 수 있다.

설정 파라미터:

  • keys: 워터마크 보안을 위해 사용되는 무작위 정수 리스트로, 타인이 워터마크를 복제하지 못하도록 안전하게 관리해야 한다.
  • ngram_len: 워터마크의 탐지 성능과 견고함 사이의 균형을 조절한다 (기본값 5).

이 요약은 원문 이해를 돕기 위한 큐레이션입니다. 저작권은 원저작자에게 있으며, 정확한 내용과 맥락은 원문을 확인하세요.

요약 오류, 출처 표기 문제, 삭제 요청은 문의 · 건의로 알려주세요.