GPT-4.5, 튜링 테스트 73% 기록하며 통과
GPT-4.5 Clears Turing Test With 73% Human Rating
·2026.05.29 20:18
핵심 내용
GPT-4.5가 통제된 환경의 튜링 테스트에서 73%의 인간 평가를 기록하며 통과했다.
자세히 보기
통제된 조건 하에서 LLM이 튜링 테스트를 통과했음을 입증하는 최초의 피어 리뷰(peer-reviewed) 및 사전 등록된 연구 결과가 발표되었다.
GPT-4.5는 73%의 인간 평가를 기록하며 튜링 테스트를 통과한 반면, GPT-4o는 무작위 확률(chance) 미만의 점수를 기록하며 극명한 성능 차이를 보였다.
이번 연구는 사기 탐지, 콘텐츠 모더레이션, 신원 확인 도구들이 'AI 생성 텍스트는 탐지 가능하다'는 가정에 기반하고 있으나, GPT-4.5 수준에서는 이러한 가정이 실패할 수 있음을 시사한다.
특히 **페르소나 지시 설계(persona instruction design)**가 기만적 사용 위험을 결정하는 핵심 변수임이 드러났으며, 이는 운영자가 단순 모델 벤치마크만으로 AI의 오용 및 기만 위험을 예측하기 어렵다는 것을 의미한다.
이 한국어 요약은 AI가 자동으로 만들었습니다. 원문의 주장과 맥락은 원문에서 확인해 주세요. 저작권은 원저작자에게 있습니다.