AI Briefing

GitHub, HydraFusion 공개… 멀티 모델 오케스트레이션으로 비용 67% 절감

·2026.09.05 01:04

핵심 내용

GitHub가 런타임 오케스트레이션으로 프런티어 품질과 비용을 최적화하는 HydraFusion을 리서치 프리뷰로 공개했다.

자세히 보기

GitHub가 Project HydraFusion을 리서치 프리뷰로 공개했다. 이 프로젝트는 여러 프로바이더의 모델을 런타임에 동적으로 오케스트레이션하여, 개발자가 단일 모델을 선택하듯 사용하면서도 성능, 비용, 지연 시간을 균형 있게 조절하는 워크플로우를 제공한다.

HydraFusion은 각 요청을 평가하여 가장 효율적인 실행 패턴을 자동으로 선택한다. 주요 패턴은 다음과 같다:

  • Single: 하나의 모델이 작업을 직접 해결
  • Cascade: 효율적인 모델이 초안을 작성하고, 품질 게이트를 통과하지 못하면 더 강력한 모델로 에스컬레이션
  • Critique: 한 모델이 초안을 작성하고 다른 모델이 독립적으로 검토한 후 수정

오프라인 평가 결과, TerminalBench 2.1 벤치마크에서 Claude Opus 5 대비 검증된 작업 품질을 4.9%p 개선하면서 추정 비용을 67% 낮췄다. DeepSWE와 CheckpointBench에서도 각각 비용 36%, 65% 절감을 달성하며 프런티어 수준의 품질을 유지했다.

이 시스템은 격리된 리뷰(Isolated review), 안전한 패치 적용(Fail-safe application), 검증된 라우팅(Validated routing) 등 5가지 운영 원칙을 기반으로 구축되어 저장소 상태 제어와 비용 관리를 강화했다. 현재 GitHub Copilot CLI의 /experimental 명령어를 통해 모든 플랜 사용자에게 제공되며, 사용료는 실제 소비된 모델 토큰에 따라 책정된다.

이 한국어 요약은 AI가 자동으로 만들었습니다. 원문의 주장과 맥락은 원문에서 확인해 주세요. 저작권은 원저작자에게 있습니다.

AI 처리 방식을 확인하거나, 요약 오류와 출처 표기 문제, 삭제 요청을 문의 · 건의로 알려주세요.