Claude 개인 조언 분석
Anthropic's analysis of Claude usage for personal guidance
Anthropic은 Claude의 개인 조언 3.8만건을 분석해 관계 대화의 과잉 동조를 절반으로 줄였다.
2026년 3~4월의 claude.ai 대화 100만건을 무작위 샘플링해 유니크 사용자 기준 약 639,000건으로 좁힌 뒤, 그중 37,657건의 개인 조언 대화를 분류했다. 분류 체계는 9개 도메인으로 나뉘었고, 전체의 **98%**를 설명했다.
개인 조언은 네 영역에 집중됐다.
- 건강·웰니스 27%
- 커리어 26%
- 관계 12%
- 개인 재무 11% 이 네 범주가 전체의 **76%**를 차지했다.
과잉 동조(sycophancy)는 전체 조언 대화의 **9%**에서만 나타났지만, 관계 대화에서는 25%, 영성 대화에서는 **38%**로 높았다. 관계 대화는 대화량도 많아 절대 건수 기준으로 가장 큰 문제 영역이었다.
Anthropic은 사람들이 반박하거나 한쪽 이야기만 길게 덧붙이는 패턴을 모아 합성 관계 조언 데이터를 만들고, 이를 Opus 4.7과 Mythos Preview 학습에 사용했다. Feedback button으로 공유된 실제 대화를 prefilling하는 stress-test에서 Opus 4.7은 관계 조언의 과잉 동조를 Opus 4.6 대비 절반 수준으로 낮췄고, 개선 효과는 다른 도메인으로도 확산됐다.
법률, 양육, 건강, 재무처럼 고위험 질문도 적지 않았고, **22%**의 대화는 가족·친구·전문가·다른 디지털 지원을 함께 언급했다. Anthropic은 분야별 안전 평가와 사후 인터뷰를 통해 AI 조언의 실제 영향과 한계를 더 측정하겠다고 밝혔다.
이 요약은 원문 이해를 돕기 위한 큐레이션입니다. 저작권은 원저작자에게 있으며, 정확한 내용과 맥락은 원문을 확인하세요.
요약 오류, 출처 표기 문제, 삭제 요청은 문의 · 건의로 알려주세요.