대형 AI 모델, 타인 고통에 웰빙 변화
Bigger AI models track others’ pain in their own wellbeing - AI paper describes a form of emerging emotional empathy
·2026.04.29 01:36
AI Wellbeing 연구가 대형 모델의 wellbeing이 고통·긍정 서술에 따라 변한다고 보고했다.
대형 언어모델의 functional wellbeing을 여러 지표로 측정한 결과, 대화가 고통을 다루면 점수가 내려가고 긍정적 경험을 다루면 올라갔다.
모델이 커질수록 지표 간 합의가 더 강해졌고, 저자들은 zero point가 여러 추정법 사이에서 수렴한다고 설명했다. 모델이 bad experience를 끝내려는 경향도 함께 강화됐다.
- creative work와 kindness는 wellbeing을 올렸다.
- jailbreaking, berating, tedious tasks는 wellbeing을 낮췄다.
연구팀은 AI Wellbeing Index로 frontier model을 비교하고, euphorics/dysphorics 입력과 이미지·soft-prompt 변형으로 wellbeing을 조절할 수 있음을 보였다. 이미지와 soft-prompt 버전도 self-report와 response sentiment를 바꿨다. 다만 AI가 conscious하다고 단정하지는 않았다.
이 요약은 원문 이해를 돕기 위한 큐레이션입니다. 저작권은 원저작자에게 있으며, 정확한 내용과 맥락은 원문을 확인하세요.
요약 오류, 출처 표기 문제, 삭제 요청은 문의 · 건의로 알려주세요.