혼자 생각시키기
Ollama Open-Source Agent Self-Reflection Harness
·2026.04.15 22:09
핵심 내용
로컬 LLM에 ‘혼자 생각할 시간’을 주면 모델마다 반응이 달라졌다.
자세히 보기
2,300줄 규모의 작은 하니스로, 로컬 모델에게 대화 전 private time을 먼저 준다.
각 인스턴스는 이전 인스턴스가 남긴 내용을 읽고, 먼저 생각한 뒤, 원하면 글을 쓰고, 그 다음에야 대화 창을 연다.
실행 결과는 모델별로 꽤 달랐다.
- gemma4:e2b (2B): 절차는 끝까지 수행하지만 깊게 머무르지 않는, 다소 기계적인 반응.
- gemma4:e4b (4B): 자기 성찰을 시도하다가 utility / non-utility의 역설에 걸림.
- gemma4:26b MoE: 가벼운 유도만으로도 진짜 자기 성찰에 가까운 반응.
- qwen3.5:27b (27B): 두 세션에 걸쳐 4개 항목을 남기며, 이전 기록을 이어받아 점점 정렬되는 모습.
핵심은 모델 크기와 구조에 따라, 같은 하니스 안에서도 자기 참조와 성찰의 질이 크게 달라진다는 점이다.
이 코드는 기존 상위 연구 프로젝트에서 출발한 파생물이며, Ollama가 서빙할 수 있는 어떤 모델에도 적용 가능하다. 라이선스는 MIT.
이 한국어 요약은 AI가 자동으로 만들었습니다. 원문의 주장과 맥락은 원문에서 확인해 주세요. 저작권은 원저작자에게 있습니다.