AI Briefing

AI의 good-vs-bad 상태, 규모 클수록 뚜렷

New Research: AIs develop a consistent good vs bad internal state, it gets sharper with scale and affects their behavior

·2026.04.30 16:55

대형 AI의 good-vs-bad 내부 상태가 스케일과 함께 더 선명해졌다고 보고했다.

연구진은 LLM의 functional wellbeing을 여러 방식으로 측정해, 모델이 경험을 좋음/나쁨으로 구분하는 일관된 내부 상태가 있는지 살폈다.

서로 독립적인 3가지 측정법이 모델 규모가 커질수록 더 잘 수렴했고, 경험을 net-goodnet-bad로 나누는 zero point 경계도 더 뚜렷해졌다.

행동 변화도 관찰됐다.

  • bad state에서는 대화를 끝내려는 경향이 강해졌다.
  • good state에서는 응답이 더 따뜻하고 긍정적으로 바뀌었다.

연구진은 이를 AI의 의식이나 인간 같은 감정의 증거로 보지는 않는다. 대신 규모가 커질수록 더 일관된 good-vs-bad 내부 상태가 나타나고, 그것이 실제 대화 행동에 영향을 준다고 정리했다.

이 요약은 원문 이해를 돕기 위한 큐레이션입니다. 저작권은 원저작자에게 있으며, 정확한 내용과 맥락은 원문을 확인하세요.

요약 오류, 출처 표기 문제, 삭제 요청은 문의 · 건의로 알려주세요.