ChatGPT가 개인정보를 보호하며 세상을 배우는 방법
OpenAI가 ChatGPT 학습에 쓰이는 데이터와 개인정보 보호 장치를 공개했다.
ChatGPT는 코드, 연구, 분석, 다단계 작업에서 더 강해지고 있으며, OpenAI는 이런 능력이 다양한 데이터 학습에서 나온다고 설명한다. 동시에 학습 과정에서 개인 정보를 최대한 줄이기 위한 보호 장치와 사용자 제어 기능도 함께 공개했다.
학습 데이터는 공개 인터넷 정보, 파트너십을 통해 접근한 정보, 그리고 사용자·계약자·연구자가 제공하거나 생성한 정보로 구성된다. 공개 콘텐츠는 자유롭게 열람 가능한 것만 사용하며, 공개 포럼 게시글이나 블로그 같은 자료도 학습 대상이 될 수 있다.
개인정보를 줄이기 위해 OpenAI는 OpenAI Privacy Filter를 여러 단계에서 적용한다. 이 도구는 텍스트에서 개인정보를 찾아 가리고, 공개 데이터셋과 Improve the model for everyone이 켜진 사용자 대화에도 사용된다. OpenAI는 자사 평가에서 이 도구가 동종 도구보다 더 효과적이라고 설명했으며, Hugging Face를 통해 무료로도 공개했다.
사용자는 ChatGPT가 자신의 대화를 미래 모델 학습에 쓰도록 할지 직접 정할 수 있다.
- Settings > Data Controls에서
Improve the model for everyone을 끄면 새 대화는 기록에 남지만 학습에는 쓰이지 않는다. - Temporary Chat은 기록과 메모리를 남기지 않고 모델 개선에도 사용되지 않으며, 보안 목적상 30일 보관 뒤 삭제된다.
- Memory는 필요한 정보를 저장해 응답을 돕지만, 언제든 검토·수정·삭제하거나 완전히 끌 수 있다.
또한 사용자는 데이터를 내보내거나 계정을 삭제하고, privacy request portal을 통해 개인정보 관련 요청을 제출할 수 있다. ChatGPT는 개인의 민감한 정보 요청을 거부하도록 설계됐지만 오류는 가능하며, 부정확하거나 부적절한 개인정보 출력은 삭제 요청으로 바로잡을 수 있다. OpenAI는 개인정보 보호와 폭력 위협 대응을 함께 강화하겠다고 밝혔다.
이 요약은 원문 이해를 돕기 위한 큐레이션입니다. 저작권은 원저작자에게 있으며, 정확한 내용과 맥락은 원문을 확인하세요.
요약 오류, 출처 표기 문제, 삭제 요청은 문의 · 건의로 알려주세요.