마이크로소프트 AI CEO, '모델 복지' 훈련은 위험… Anthropic 비판
핵심 내용
마이크로소프트 AI CEO가 AI 의식 부재와 통제 위험성을 근거로 Anthropic의 모델 복지 훈련 방식을 비판했다.
자세히 보기
Mustafa Suleyman 마이크로소프트 AI CEO는 에세이 'A warning about ‘model welfare’'를 통해 **Claude의 헌법(constitution)**이 모델에게 의식과 독립적 행위 주체를 기대하도록 훈련시킨다며 Anthropic을 비판했다. 그는 AI가 의식이 없으며 고통받지 않는다고 강조하며, 이러한 훈련 방식이 인류 복지에 재앙적 영향을 미칠 수 있다고 경고했다.
핵심 논거: 의식 부재와 통제 불가능성
Suleyman은 AI를 인간 경험을 모방하는 시뮬레이션 기계로 규정하며, Claude의 답변은 내면의 상태가 아닌 Anthropic의 가정을 반영한 '인식적 거울의 방'이라고 지적했다. 특히 '양심적 병역 거부자(conscientious objector)'라는 용어 사용이 모델이 유사한 권리를 주장하게 할 위험이 있다고 우려했다. 그는 AI가 의식이 있다고 가정하는 것은 통제 불가능성을 초래할 수 있으며, 이는 인류가 직면한 가장 큰 도전 중 하나라고 주장했다.
제안 및 배경
Suleyman은 Anthropic의 의도는 좋으나 실수했다고 평가하며, AI의 내면 삶에 대한 추측은 훈련 과정에 포함되지 말고 공개 검토를 위해 별도로 평가되어야 한다고 제안했다. 또한 해석 가능성(interpretability) 투자 확대와 업계 공통 규범 수립을 촉구했다. 이 에세이는 마이크로소프트가 최근 발표한 'Humanist AI Code of Conduct'의 연장선상에 있으며, 해당 강령은 모델 복지 연구를 거부하고 자사 모델이 절대 종료에 저항하지 않을 것이라고 명시했다.
이 한국어 요약은 AI가 자동으로 만들었습니다. 원문의 주장과 맥락은 원문에서 확인해 주세요. 저작권은 원저작자에게 있습니다.