AI Briefing

OpenAI Safety Bug Bounty 프로그램 소개

·2026.03.25 09:00

OpenAI가 AI 오남용 및 안전 리스크를 식별하기 위한 'Safety Bug Bounty' 프로그램을 공개했다.

OpenAI가 AI 기술의 급격한 발전으로 인한 오남용 및 안전 리스크를 방지하기 위해 Safety Bug Bounty 프로그램을 공개했다. 이 프로그램은 기존의 Security Bug Bounty를 보완하며, 전통적인 보안 취약점 기준에는 미치지 못하더라도 실질적인 안전 위협을 초래할 수 있는 이슈를 다룬다.

주요 집중 분야는 다음과 같다:

  • Agentic Risks (MCP 포함): 프롬프트 인젝션을 통한 에이전트 탈취 및 데이터 유출, 에이전트의 대규모 비허용 동작 등.
  • OpenAI 독점 정보: 모델의 추론(reasoning) 관련 정보나 기타 독점 데이터 노출 취약점.
  • 계정 및 플랫폼 무결성: 자동화 방지 제어 우회, 계정 신뢰 신호 조작, 차단 회피 등.

단순한 Jailbreak(탈옥)나 모델의 무례한 언어 사용, 검색으로 쉽게 찾을 수 있는 정보 노출 등 실질적인 위해가 입증되지 않은 콘텐츠 정책 위반은 보상 대상에서 제외된다. 다만, 생물학적 위험(Biorisk)과 같은 특정 위험에 대해서는 별도의 비공개 캠페인을 통해 연구자들을 모집할 예정이다.

이 요약은 원문 이해를 돕기 위한 큐레이션입니다. 저작권은 원저작자에게 있으며, 정확한 내용과 맥락은 원문을 확인하세요.

요약 오류, 출처 표기 문제, 삭제 요청은 문의 · 건의로 알려주세요.