AI Briefing

NVIDIA NemoClaw로 만든 기억하는 에이전트, 지식과 판단을 분리해 정확도 82.8% → 90.9%로 개선

·2026.09.09 12:30

핵심 내용

NVIDIA가 지식과 판단을 분리한 NemoClaw 기반 에이전트를 공개해 벤치마크 정확도를 90.9%로 개선했다.

1 / 4

자세히 보기

NVIDIA가 2026년 9월 4일, NemoClaw 기반의 'Memory-Driven Chief of Staff' 에이전트를 공개했다. 이 시스템은 대화 기록이나 RAG의 한계를 극복하기 위해 **지식(사실)**과 **판단(의견)**을 구조적으로 분리하여, 벤치마크 정확도를 기존 82.8%에서 **90.9%**로 끌어올렸다.

아키텍처 및 핵심 기술

에이전트는 마크다운 위키로 지식을 저장하고, SQLite로 판단을 기록하며, Rust 기반 OpenShell로 실행 통제를 수행한다. 특히 '맥락은 행동을 승인할 수 없다'는 원칙 하에 메모리는 추천만 가능하며, 실제 행동은 자격 증명과 사용자 승인을 거치도록 설계됐다. 자기 모델은 원문과 파생 해석을 분리 저장해 디버깅 용이성을 확보했다.

성능 및 비용 분석

Nemotron 3 Ultra 기준의 벤치마크에서 시간축 지표(chain_freshness +40%p, as_of +33.3%p)가 크게 향상됐다. 다만, 수집 단계에서 1.83억 토큰이 소요되는 등 비용 효율성 측면에서는 과제가 남아 있다. 질문당 토큰 사용량도 기준선 대비 높아 '수집비 투자 후 절감' 논거는 성립하지 않는 것으로 나타났다.

배포 및 라이선스

현재 배포본은 Slack과 Outlook 커넥터만 지원하며, 프로덕션 환경이 아닌 참조 레시피 수준이다. NemoClaw와 OpenShell, 벤치마크 데이터셋은 Apache License 2.0으로 공개되어 연구 및 상업적 사용이 가능하다.

이 한국어 요약은 AI가 자동으로 만들었습니다. 원문의 주장과 맥락은 원문에서 확인해 주세요. 저작권은 원저작자에게 있습니다.

AI 처리 방식을 확인하거나, 요약 오류와 출처 표기 문제, 삭제 요청을 문의 · 건의로 알려주세요.