GPT-4.5, 튜링 테스트 73% 기록하며 통과
GPT-4.5 Clears Turing Test With 73% Human Rating
·2026.05.29 20:18
GPT-4.5가 통제된 환경의 튜링 테스트에서 73%의 인간 평가를 기록하며 통과했다.
통제된 조건 하에서 LLM이 튜링 테스트를 통과했음을 입증하는 최초의 피어 리뷰(peer-reviewed) 및 사전 등록된 연구 결과가 발표되었다.
GPT-4.5는 73%의 인간 평가를 기록하며 튜링 테스트를 통과한 반면, GPT-4o는 무작위 확률(chance) 미만의 점수를 기록하며 극명한 성능 차이를 보였다.
이번 연구는 사기 탐지, 콘텐츠 모더레이션, 신원 확인 도구들이 'AI 생성 텍스트는 탐지 가능하다'는 가정에 기반하고 있으나, GPT-4.5 수준에서는 이러한 가정이 실패할 수 있음을 시사한다.
특히 **페르소나 지시 설계(persona instruction design)**가 기만적 사용 위험을 결정하는 핵심 변수임이 드러났으며, 이는 운영자가 단순 모델 벤치마크만으로 AI의 오용 및 기만 위험을 예측하기 어렵다는 것을 의미한다.
이 요약은 원문 이해를 돕기 위한 큐레이션입니다. 저작권은 원저작자에게 있으며, 정확한 내용과 맥락은 원문을 확인하세요.
요약 오류, 출처 표기 문제, 삭제 요청은 문의 · 건의로 알려주세요.