AI Briefing

Mesh LLM: iroh 기반의 분산 AI 컴퓨팅

·2026.07.12 07:38

핵심 내용

여러 대의 기기에 분산된 GPU와 메모리를 하나의 OpenAI 호환 API로 통합하는 Mesh LLM이 공개되었습니다.

자세히 보기

Mesh LLM은 개별 기기(노트북, GPU 리그, 미니 PC, 서버 등)의 컴퓨팅 자원을 하나로 묶어 OpenAI 호환 API로 제공하는 분산 추론 프레임워크입니다.

이 시스템은 iroh 프로토콜을 사용하여 중앙 서버 없이 기기 간 직접적인 QUIC 연결을 형성하며, NAT 트래버설과 홀 펀칭을 통해 복잡한 네트워크 환경에서도 통신을 지원합니다.

주요 작동 방식은 다음과 같습니다:

  • 로컬 실행: 현재 기기의 GPU를 직접 사용
  • 라우팅: 모델이 이미 로드된 다른 피어(Peer)로 요청 전달
  • 모델 분할(Split Mode): 단일 기기에서 실행 불가능한 거대 모델을 여러 기기에 레이어 단위로 나누어 실행하는 'Skippy' 기술 적용

Mesh LLM은 MCP, HTTP, inference 등을 통해 플러그인 아키텍처를 지원하며, 5억 파라미터 규모의 소형 모델부터 235B 파라미터 규모의 MoE 모델까지 40개 이상의 모델 카탈로그를 제공합니다.

이 한국어 요약은 AI가 자동으로 만들었습니다. 원문의 주장과 맥락은 원문에서 확인해 주세요. 저작권은 원저작자에게 있습니다.

AI 처리 방식을 확인하거나, 요약 오류와 출처 표기 문제, 삭제 요청을 문의 · 건의로 알려주세요.