Anthropic, Claude Code 프롬프트 제안은 RLHF 학습용 아니라고 해명
·2026.10.07 13:32
핵심 내용
Anthropic 엔지니어가 Claude Code의 프롬프트 제안은 RLHF 학습용이 아니라고 밝혔다.
자세히 보기
커뮤니티에서는 Claude Code의 새 프롬프트 제안 기능이 Reinforcement Learning from Human Feedback (RLHF) 데이터를 수집하는 메커니즘이라는 추측이 제기됐다. 사용자가 제안된 프롬프트를 수정하는 과정이 고품질 선호도 쌍을 만들어 기존 아노테이션보다 저렴하고 분포에 맞는 대안을 제공할 것이라는 주장이었다.
하지만 Anthropic 엔지니어 edwinarbus는 Hacker News에서 이 해석을 반박했다. 그는 프롬프트 제안이 사용자가 흐름을 유지하거나 휴식 후 다음 단계를 떠올리도록 돕는 용도일 뿐이며, 선호도 신호를 수집하는 데 사용되지 않는다고 밝혔다.
Anthropic의 주요 해명:
- 목적: 이 기능은 편의 도구일 뿐, 학습을 위한 데이터 수집 장치가 아니다.
- 지표: Anthropic은 제안 수용률을 추적하지만 이는 기능의 유용성을 측정하기 위함이지 모델 학습용이 아니다.
- 설계: 제안은 흐리게 표시되고 수정 가능하며 '자동 고침'과 구별되며, 설정에서 끌 수 있다.
이 한국어 요약은 AI가 자동으로 만들었습니다. 원문의 주장과 맥락은 원문에서 확인해 주세요. 저작권은 원저작자에게 있습니다.