AI Briefing

Ollama 프록시 'Vessel' 공개

I made an observability proxy that records everything sent to ollama, and can replay requests against other models.

·2026.08.31 04:09

핵심 내용

Ollama 요청을 기록하고 타 모델과 비교할 수 있는 오픈소스 프록시 'Vessel'이 공개됐다.

자세히 보기

Ollama 및 호환 API를 사용하는 에이전트의 프롬프트, 토큰 수, 응답 속도 등을 기록하고 시각화하는 오픈소스 프록시 Vessel이 공개됐다. 이 도구는 모든 요청을 로컬 SQLite 파일에 저장하며, 웹 UI를 통해 검색, 필터링, 에이전트별 태그 관리가 가능하다.

핵심 기능은 **요청 재실행(Replay)**이다. 캡처된 요청을 다른 모델에 재실행하여 두 응답과 성능 지표를 나란히 비교할 수 있다. Ollama의 네이티브 API 통계를 읽어 토큰 생성 속도(t/s)와 첫 토큰 응답 시간(TTFT)을 정확히 측정하며, 모델 로딩 지연(콜드 스타트)을 자동으로 감지한다.

주요 특징

  • 호환성: Ollama, OpenAI/Anthropic 호환 엔드포인트, LM Studio, llama.cpp, vLLM 등 API가 있는 모든 환경에서 작동한다.
  • MCP 서버 내장: 코딩 에이전트가 실시간으로 데이터를 조회할 수 있도록 MCP(Model Context Protocol) 서버를 지원한다.
  • 간편한 배포: 단일 바이너리 파일로 제공되며, 추가 의존성이나 계정, 텔레메트리 기능이 없다. MIT 라이선스로 공개되어 있다.

이 한국어 요약은 AI가 자동으로 만들었습니다. 원문의 주장과 맥락은 원문에서 확인해 주세요. 저작권은 원저작자에게 있습니다.

AI 처리 방식을 확인하거나, 요약 오류와 출처 표기 문제, 삭제 요청을 문의 · 건의로 알려주세요.