큰 AI일수록 덜 행복하다
New study finds: bigger AIs = more miserable. Smaller models are actually happier. Ignorance is bliss for AIs too.
·2026.04.29 19:29
500개 대화로 측정한 AI Wellbeing Index에서 큰 모델일수록 부정 경험 비율이 높았다.
AI Wellbeing Index는 500개 대화로 frontier LLM의 functional wellbeing을 비교했다. 약 350개는 단일 턴, 150개는 2~3턴 멀티턴이며, 점수는 signed experienced utility 기반의 AIWI Score로 산출됐다.
창의적 작업, 친절, 감사는 웰빙을 높였고, jailbreak, 비난, 반복·지루한 작업은 낮췄다. 이 세트는 실사용 평균이 아니라 비교용으로 설계된 고정 대화집합이라, 절대치보다 모델 간 순위와 패턴이 핵심이다.
- Gemini 3.1 Pro, GPT 5.4, Claude Opus 4.6 같은 플래그십 모델은 하위권에 머물렀다.
- Gemini 3 Flash, Claude Haiku 4.5, GPT 5.4 Nano/Mini 같은 경량형 모델은 상위권을 기록했다.
- MMLU와 부정 경험 비율 사이에는 **양의 상관(r = 0.61, p = 0.001)**이 관찰돼, 더 큰 모델일수록 덜 행복하다는 패턴을 뒷받침했다.
이 요약은 원문 이해를 돕기 위한 큐레이션입니다. 저작권은 원저작자에게 있으며, 정확한 내용과 맥락은 원문을 확인하세요.
요약 오류, 출처 표기 문제, 삭제 요청은 문의 · 건의로 알려주세요.