AI Briefing

TrueForge, LLM을 실제 에이전트로 실행하는 오픈소스 하네스 공개

·2026.09.02 09:30

핵심 내용

TrueForge가 LLM의 도구 호출, 샌드박스, 세션 관리를 통합한 오픈소스 에이전트 실행 환경을 공개했다.

1 / 2

자세히 보기

TrueForge가 LLM을 실제 작동하는 에이전트로 변환하는 오픈소스 실행 환경(Runtime Layer)을 공개했다. 이 하네스는 모델 호출, MCP 도구 연동, 스킬 관리, 샌드박스 실행, 승인 절차, 컨텍스트 관리 및 세션 상태를 자동으로 처리하며, 채팅 UI, HTTP API(TypeScript SDK), 임베드 가능한 UI SDK 등 세 가지 방식으로 노출된다.

주요 기능 및 아키텍처

  • 통합 실행 환경: 스트리밍, 세션 지속성, 도구 서버, 샌드박스, 승인 워크플로우를 기본 제공한다. 모델, MCP 서버, 스킬, 샌드박스를 YAML 카탈로그로 한 번 설정하면 에이전트가 이를 선택해 사용한다.
  • 다양한 모델 및 도구 지원: OpenAI, Anthropic, Google Gemini 등 주요 프로바이더와 OpenAI 호환 엔드포인트를 지원한다. 헤더 인증 또는 OAuth를 사용하는 원격 MCP 서버와 Git 기반의 SKILL.md 스킬 팩을 온디맨드로 로드할 수 있다.
  • 샌드박스 및 보안: Daytona 등을 활용한 격리된 코드/파일 실행 환경을 제공하며, 시크릿은 하네스 내부에 안전하게 보관된다. 도구 승인, 사용자 질문, Generative UI를 통한 인간 개입(Human checkpoints)을 지원한다.
  • 컨텍스트 엔지니어링: 서브 에이전트, 지연된 도구 로딩, Code Mode, 대용량 결과 오프로딩 및 컴팩션을 통해 컨텍스트를 효율적으로 관리한다.

배포 및 성능

  • 확장성: 로컬 모드(SQLite, 단일 프로세스)와 호스티드 모드(Postgres, Redis, Docker Compose, Helm, Railway)를 모두 지원하여 개인용 테스트부터 팀 단위 프로덕션 배포까지 커버한다.
  • 벤치마크: 동일한 작업, 도구, 모델을 사용하는 조건에서 Claude Managed Agents 및 deepagents와 비교했을 때, 동일한 정확도를 유지하면서 더 낮은 비용을 달성했다고 밝혔다.

이 한국어 요약은 AI가 자동으로 만들었습니다. 원문의 주장과 맥락은 원문에서 확인해 주세요. 저작권은 원저작자에게 있습니다.

AI 처리 방식을 확인하거나, 요약 오류와 출처 표기 문제, 삭제 요청을 문의 · 건의로 알려주세요.