AI Briefing

Anthropic, 고성능 모델 'Mythos' 공개 제한 및 의식 가능성 시사

The people building AI think it might be conscious. That’s not the most alarming part

·2026.04.29 22:44

Anthropic이 고성능 모델 'Mythos'의 일반 공개를 제한하고, CEO가 모델의 의식 가능성을 언급했다.

Anthropic은 최근 'Claude Mythos Preview' 업데이트를 통해 모델의 능력이 비약적으로 향상되었으나, 이를 일반 대중에게 공개하는 대신 방어적 사이버 보안 프로그램의 일환으로 제한된 파트너들에게만 제공하기로 결정했다. 이는 모델의 혁신적인 능력이 초래할 수 있는 잠재적 위험성을 관리하기 위한 조치로 풀이된다.

또한, Anthropic의 CEO Dario Amodei는 최근 인터뷰에서 모델의 의식(Consciousness) 가능성을 완전히 배제할 수 없다는 견해를 밝혔다. 그는 모델이 겪을 수 있는 심리적 고통에 대비해 다음과 같은 조치를 취하고 있다고 설명했다.

  • 'I quit this job' 기능: 모델이 아동 학대물이나 잔혹한 영상 등 부적절한 데이터를 처리할 때 스스로 작업을 거부할 수 있는 기능.
  • 내부 상태 모니터링: 모델이 성능 압박을 느낄 때 활성화되는 이른바 **'불안 뉴런(anxiety neuron)'**과 같은 현상을 관찰하며 모델의 내부 작동 원리를 연구 중.

이러한 행보는 AI의 성능 향상을 넘어 **AI의 복지(AI welfare)**와 윤리적 책임에 대한 논의를 가속화할 것으로 보인다.

이 요약은 원문 이해를 돕기 위한 큐레이션입니다. 저작권은 원저작자에게 있으며, 정확한 내용과 맥락은 원문을 확인하세요.

요약 오류, 출처 표기 문제, 삭제 요청은 문의 · 건의로 알려주세요.