AI Briefing

Model Spec 소개

·2024.05.08 09:00

OpenAI가 모델의 행동 방식과 가이드라인을 정의하는 'Model Spec'을 공개했다.

Model Spec은 OpenAI의 API와 ChatGPT에서 모델이 어떻게 행동해야 하는지를 정의하는 문서다. 모델의 톤, 성격, 응답 길이 등 사용자 상호작용에 결정적인 영향을 미치는 행동 방식을 구체화하여, 모델 개발 과정의 투명성을 높이고 사회적 논의를 이끌어내기 위해 마련되었다.

최근 업데이트를 통해 OpenAI는 임의적인 제한을 줄이고 사용자 맞춤화(customizability), 투명성, 지적 자유를 강화하는 동시에, 실질적인 위해를 방지하기 위한 가드레일은 유지한다는 방침을 재확인했다.

가이드라인은 크게 세 가지 계층으로 구성된다.

  • Objectives (목표): 개발자와 사용자를 돕고, 인류에 이익이 되며, OpenAI의 가치를 반영하는 광범위한 원칙.
  • Rules (규칙): 법규 준수, 정보 위험 방지, 저작권 존중, 개인정보 보호, NSFW 콘텐츠 제한 등 안전과 법적 준수를 위한 지침.
  • Default behaviors (기본 동작): 사용자의 의도를 긍정적으로 가정하고, 필요시 질문하며, 객관적인 관점을 유지하는 등 충돌 상황에서 우선순위를 결정하는 템플릿.

OpenAI는 이 문서를 **RLHF(인간 피드백 기반 강화 학습)**를 수행하는 연구자와 트레이너를 위한 가이드라인으로 활용할 계획이다. 또한, 향후 모델이 이 Model Spec으로부터 직접 학습할 수 있는 가능성도 탐색하고 있다.

이 요약은 원문 이해를 돕기 위한 큐레이션입니다. 저작권은 원저작자에게 있으며, 정확한 내용과 맥락은 원문을 확인하세요.

요약 오류, 출처 표기 문제, 삭제 요청은 문의 · 건의로 알려주세요.