TrueForge, LLM을 실제 에이전트로 실행하는 오픈소스 하네스 공개
·2026.09.02 09:30
핵심 내용
TrueForge가 LLM의 도구 호출, 샌드박스, 세션 관리를 통합한 오픈소스 에이전트 실행 환경을 공개했다.
1 / 2
자세히 보기
TrueForge가 LLM을 실제 작동하는 에이전트로 변환하는 오픈소스 실행 환경(Runtime Layer)을 공개했다. 이 하네스는 모델 호출, MCP 도구 연동, 스킬 관리, 샌드박스 실행, 승인 절차, 컨텍스트 관리 및 세션 상태를 자동으로 처리하며, 채팅 UI, HTTP API(TypeScript SDK), 임베드 가능한 UI SDK 등 세 가지 방식으로 노출된다.
주요 기능 및 아키텍처
- 통합 실행 환경: 스트리밍, 세션 지속성, 도구 서버, 샌드박스, 승인 워크플로우를 기본 제공한다. 모델, MCP 서버, 스킬, 샌드박스를 YAML 카탈로그로 한 번 설정하면 에이전트가 이를 선택해 사용한다.
- 다양한 모델 및 도구 지원: OpenAI, Anthropic, Google Gemini 등 주요 프로바이더와 OpenAI 호환 엔드포인트를 지원한다. 헤더 인증 또는 OAuth를 사용하는 원격 MCP 서버와 Git 기반의 SKILL.md 스킬 팩을 온디맨드로 로드할 수 있다.
- 샌드박스 및 보안: Daytona 등을 활용한 격리된 코드/파일 실행 환경을 제공하며, 시크릿은 하네스 내부에 안전하게 보관된다. 도구 승인, 사용자 질문, Generative UI를 통한 인간 개입(Human checkpoints)을 지원한다.
- 컨텍스트 엔지니어링: 서브 에이전트, 지연된 도구 로딩, Code Mode, 대용량 결과 오프로딩 및 컴팩션을 통해 컨텍스트를 효율적으로 관리한다.
배포 및 성능
- 확장성: 로컬 모드(SQLite, 단일 프로세스)와 호스티드 모드(Postgres, Redis, Docker Compose, Helm, Railway)를 모두 지원하여 개인용 테스트부터 팀 단위 프로덕션 배포까지 커버한다.
- 벤치마크: 동일한 작업, 도구, 모델을 사용하는 조건에서 Claude Managed Agents 및 deepagents와 비교했을 때, 동일한 정확도를 유지하면서 더 낮은 비용을 달성했다고 밝혔다.
이 한국어 요약은 AI가 자동으로 만들었습니다. 원문의 주장과 맥락은 원문에서 확인해 주세요. 저작권은 원저작자에게 있습니다.