AI Briefing

집단적 정렬: Model Spec에 대한 대중의 피드백

·2025.08.27 22:00

OpenAI가 1,000명 이상의 대중 의견을 수렴해 Model Spec을 개선하고 데이터셋을 공개했다.

OpenAI는 AI 모델이 인류의 다양한 가치와 우선순위를 반영할 수 있도록 하는 collective alignment(집단적 정렬) 연구를 진행했다. 이를 위해 전 세계 1,000명 이상의 참여자를 대상으로 모델의 행동 방식에 대한 의견을 수렴했다.

설문 결과 대중의 선호도는 기존 Model Spec과 대체로 일치했으나, 불일치하는 지점에 대해서는 다음과 같이 대응했다.

  • 명확화(Clarifications): 기존 원칙과 일치하지만 해석의 여지가 있는 문구를 수정
  • 원칙 변경(Change-of-principles): 기존 원칙과 다른 새로운 행동 지침 제안

OpenAI는 수렴된 의견 중 일부는 반영하고, 일부는 향후 과제로 미루거나 원칙 및 실현 가능성에 따라 제외했다. 또한, AI 연구 생태계의 발전을 위해 수집된 데이터셋을 HuggingFace에 공개했다.

이 요약은 원문 이해를 돕기 위한 큐레이션입니다. 저작권은 원저작자에게 있으며, 정확한 내용과 맥락은 원문을 확인하세요.

요약 오류, 출처 표기 문제, 삭제 요청은 문의 · 건의로 알려주세요.