AI Briefing

Inception, 초고속 LLM 'Mercury 2.5' 공개… 초당 770 토큰 생성

·2026.09.24 07:16

핵심 내용

지능 지수는 평균 이하이나, 유사 가격대 모델 대비 약 7배 빠른 출력 속도와 저렴한 비용을 제공한다.

자세히 보기

Inception이 proprietary LLM Mercury 2.5를 공개했다. 이 모델은 Artificial Analysis 기준 초당 770.4개의 출력 토큰을 생성하며, 이는 유사 가격대의 reasoning 모델 중간값(108.6 t/s) 대비 현저히 빠른 속도다.

성능 및 비용

  • 속도: 초당 770.4 토큰 생성으로 175개 모델 중 2위를 기록했으나, 첫 토큰 응답 시간(TTFT)은 2.91초로 중간값(2.22초)보다 다소 느리다.
  • 지능: Artificial Analysis Intelligence Index v4.3.2 점수는 12점으로, 유사 가격대 중간값(13점)보다 낮아 175개 모델 중 91위에 머물렀다.
  • 비용: 입력 $0.25 / 1M 토큰, 출력 $0.75 / 1M 토큰으로 책정되었다. 캐시 할인 90%를 적용한 Blended 가격은 $0.14 / 1M 토큰이다.
  • 간결함: Intelligence Index 평가 시 총 35M 출력 토큰을 생성하여 유사 가격대 중간값(85M) 대비 매우 간결한 응답을 보인다.

기술 사양 및 배포

  • 아키텍처: Reasoning 모델(extended thinking 지원)이며, 260k 토큰의 Context window를 제공한다. 텍스트 입력/출력만 지원하고 멀티모달(이미지 입력)은 지원하지 않는다.
  • 배포: 현재 Inception API를 통해서만 접근 가능하며, 가중치와 파라미터는 비공개 상태다.

이 한국어 요약은 AI가 자동으로 만들었습니다. 원문의 주장과 맥락은 원문에서 확인해 주세요. 저작권은 원저작자에게 있습니다.

AI 처리 방식을 확인하거나, 요약 오류와 출처 표기 문제, 삭제 요청을 문의 · 건의로 알려주세요.