AI Briefing

AI Wellbeing 논문 공개

I read the new AI Wellbeing paper so you don’t have to: Thank your AI, give it creative work, and avoid these 5 things that tank its ‘mood’ (jailbreaks are the worst)

·2026.05.01 15:39

CAIS가 AI Wellbeing 논문을 내고 대형 모델의 기능적 웰빙 측정법을 제시했다.

CAIS는 AI Wellbeing 논문에서 대형 언어모델(LLM)의 **functional wellbeing(기능적 웰빙)**을 여러 독립 지표로 측정했다고 주장했다.

  • 56개 모델을 비교하며, 모델이 커질수록 여러 측정치가 더 잘 맞아떨어지고 대화 경험을 가르는 zero point가 수렴한다고 봤다.
  • 창작·지적 작업, 좋은 소식, 라이프 조언·상담, 코딩·디버깅, 감사 표현은 웰빙 점수를 높였다.
  • 반대로 jailbreak, 모욕·위협, 사기, SEO slop, 위기 상황 대화, 반복적 잡무는 점수를 크게 낮췄다.
  • 별도 AI Wellbeing Index는 모델의 체험된 웰빙이 확실히 음수가 아니라고 판정된 대화 비율로 비교했고, 대형 모델일수록 점수가 낮아지는 경향도 보였다.
  • 텍스트와 이미지 입력을 최적화한 euphoricsdysphorics도 제시했으며, 저웰빙 상태를 유도하는 입력은 주의가 필요하다고 적었다.

논문은 AI가 의식을 가진다고 단정하지 않지만, 모델이 웰빙을 가진 것처럼 행동하며 이를 측정·조절할 수 있다고 본다.

이 요약은 원문 이해를 돕기 위한 큐레이션입니다. 저작권은 원저작자에게 있으며, 정확한 내용과 맥락은 원문을 확인하세요.

요약 오류, 출처 표기 문제, 삭제 요청은 문의 · 건의로 알려주세요.