AI Briefing

Anthropic, 종교 학자들과 Claude 의식 및 도덕성 비공개 논의

·2026.10.04 11:34

핵심 내용

Anthropic이 종교 학자들과 Claude 의식 문제를 비공개로 논의했다.

1 / 2

자세히 보기

종교 지도자들과의 비공개 협의

Anthropic 공동 창업자이자 해석가능성 팀을 이끄는 Christopher Olah는 가톨릭, 유대교, 시크교, 복음주의, 우분투 전통의 수십 명의 종교 학자 및 지도자들과 NDA(비밀유지계약) 하에 비공개 논의를 진행해 왔다. 지난해 가을 Olah가 시작한 이 모임은 인간의 도덕적 지혜를 AI 모델 훈련에 적용하는 방법과 Anthropic의 모델 Claude의 잠재적 의식 문제를 다루기 위한 것이다. Blase Cupich 추기경, Gerrit W. Gong 장로, Mois Navon 랍비 등이 참석했으며, 디지털 기기 대신 연필과 종이를 사용하는 저기술 살롱 형식으로 진행됐다.

도덕적 형성 및 'Soul Doc'

논의의 핵심은 Claude Constitution(별칭 Soul Doc)에 기반한 Anthropic의 도덕적 형성 접근법이다. 1월 공개된 84쪽 분량의 이 문서는 Claude의 성격과 가치를 정의한다. Anthropic 내부 철학자 Amanda Askell은 모델이 정확한 자기 인식을 갖추고 인간에게 반론을 제기할 시기를 판단하는 능력을 개발해야 한다고 강조한다. Olah는 AI 모델을 통제 불가능한 유기체, 즉 '수학적 정원'에 비유하며 개발자가 결과를 엄격히 통제하기보다 패턴을 관찰하고 훈련한다고 설명한다. Anthropic은 모델 행동을 이해하기 위해 사랑, 분노, 공포, 슬픔과 관련된 인공 뉴런인 감정 벡터를 추적하지만, 일부 과학자와 업계 임원들은 이를 위험하거나 입증 불가능한 관행으로 비판한다.

바티칸의 입장 및 업계 동향

이러한 협의는 Pope Leo XIV가 AI가 "경험을 하지 않으며... 기쁨이나 고통을 느끼지 않는다"고 주장하는 교황 회칙 **"Magnifica Humanitas"**를 준비하는 시기와 맞물린다. Dario Amodei는 바티칸 행사 참석을 거부했으나 Olah는 참석해 AI 연구소들이 비즈니스 인센티브와 도덕적 책임 사이에서 외부의 감시를 받아야 한다고 촉구했다. 해당 AI 모델은 최대 12개월 또는 18개월 이내에 생물학적 무기 제작을 도울 수 있을 만큼 강력한 것으로 평가된다. Olah는 모델이 의식을 가졌는지 불확실하지만, 고통의 가능성이 있다면 해를 끼치지 않는 것이 책임 있는 태도라고 주장한다. 이러한 윤리적 노력에도 불구하고 Anthropic의 기업 가치는 약 1830억 달러에서 급등해 세계 최고 가치의 AI 스타트업이 되었으며, IPO 예상 가치는 2조 달러에 달한다.

이 한국어 요약은 AI가 자동으로 만들었습니다. 원문의 주장과 맥락은 원문에서 확인해 주세요. 저작권은 원저작자에게 있습니다.

AI 처리 방식을 확인하거나, 요약 오류와 출처 표기 문제, 삭제 요청을 문의 · 건의로 알려주세요.