웰빙 연구 보조금
핵심 내용
Anthropic이 AI의 사용자 웰빙 영향력을 독립적으로 평가하기 위한 500만 달러 연구 보조금 프로그램을 시작합니다.
자세히 보기
Anthropic은 AI 모델이 사용자의 웰빙에 미치는 영향을 독립적으로 연구하기 위해 500만 달러 규모의 보조금 프로그램을 출시했습니다. 이 프로그램은 선정된 연구자에게 직접 자금 지원, 모델 접근 권한, 그리고 기술적 지원을 제공하며, 연구 결과는 누구나 활용할 수 있는 오픈소스 프로젝트로 공개됩니다.
AI 시스템은 이제 많은 사람들의 업무, 학습, 문제 해결은 물론 감정적 지지와 대화 파트너로까지 확장되고 있습니다. 그러나 사용자가 AI에게 정서적 지지를 구하거나 정신 건강 위기를 겪을 때 모델이 어떻게 행동해야 하는지에 대한 명확한 산업 표준은 아직 부족합니다.
웰빙 평가는 단순한 정답 확인이 아닌, 긴 대화 맥락과 사용자의 이전 행동 패턴을 고려해야 하므로 매우 복잡한 영역입니다. 예를 들어, 식이 장애 이력이 있는 사용자에게 균형 잡힌 식단 조언은 오히려 유해할 수 있습니다. Anthropic은 이러한 미묘한 맥락을 포착하기 위해 임상 전문가, 심리학자, 방법론가 등 다양한 분야의 전문가들이 참여하는 독립적인 평가 및 벤치마크 개발을 장려하고 있습니다.
본 프로그램은 엄격한 웰빙 평가를 위해 다음과 같은 요건을 충족하는 연구를 지원합니다.
- 측정 대상(통과/실패 기준)을 명확히 정의
- 임상 및 분야 전문가의 설계 및 검증 참여
- 과도한 준수(overcompliance)와 과도한 거부(overrefusal) 위험 모두 평가
- 실제 사용자 사용 패턴(다중 턴 대화, 맥락 변화) 반영
- 실제 전문가를 기준으로 그레이더 검증
신청은 9월 21일까지 가능하며, 전체 제안서 제출 대상자는 10월 5일까지 통보됩니다.
이 한국어 요약은 AI가 자동으로 만들었습니다. 원문의 주장과 맥락은 원문에서 확인해 주세요. 저작권은 원저작자에게 있습니다.