Inception, 초고속 LLM 'Mercury 2.5' 공개… 초당 770 토큰 생성
·2026.09.24 07:16
핵심 내용
지능 지수는 평균 이하이나, 유사 가격대 모델 대비 약 7배 빠른 출력 속도와 저렴한 비용을 제공한다.
자세히 보기
Inception이 proprietary LLM Mercury 2.5를 공개했다. 이 모델은 Artificial Analysis 기준 초당 770.4개의 출력 토큰을 생성하며, 이는 유사 가격대의 reasoning 모델 중간값(108.6 t/s) 대비 현저히 빠른 속도다.
성능 및 비용
- 속도: 초당 770.4 토큰 생성으로 175개 모델 중 2위를 기록했으나, 첫 토큰 응답 시간(TTFT)은 2.91초로 중간값(2.22초)보다 다소 느리다.
- 지능: Artificial Analysis Intelligence Index v4.3.2 점수는 12점으로, 유사 가격대 중간값(13점)보다 낮아 175개 모델 중 91위에 머물렀다.
- 비용: 입력 $0.25 / 1M 토큰, 출력 $0.75 / 1M 토큰으로 책정되었다. 캐시 할인 90%를 적용한 Blended 가격은 $0.14 / 1M 토큰이다.
- 간결함: Intelligence Index 평가 시 총 35M 출력 토큰을 생성하여 유사 가격대 중간값(85M) 대비 매우 간결한 응답을 보인다.
기술 사양 및 배포
- 아키텍처: Reasoning 모델(extended thinking 지원)이며, 260k 토큰의 Context window를 제공한다. 텍스트 입력/출력만 지원하고 멀티모달(이미지 입력)은 지원하지 않는다.
- 배포: 현재 Inception API를 통해서만 접근 가능하며, 가중치와 파라미터는 비공개 상태다.
이 한국어 요약은 AI가 자동으로 만들었습니다. 원문의 주장과 맥락은 원문에서 확인해 주세요. 저작권은 원저작자에게 있습니다.