AI Briefing

IFM, K2-Horizon-7B 공개

IFM/K2-Horizon-7B-Uno · Hugging Face - 5200tps with no quality loss

·2026.09.18 03:43

핵심 내용

IFM이 인과적 LLM에 확산 어댑터를 결합한 K2-Horizon-7B를 공개했으며, 최대 5200 tps의 추론 속도와 무손실 성능을 주장한다.

자세히 보기

IFM이 인과적(causal) LLM 아키텍처에 플러그 앤 플레이(plug-and-play) 방식의 확산(diffusion) 어댑터를 결합한 K2-Horizon-7B를 공개했다. 이 모델은 기존 자기회귀(autoregressive) 가중치와 함께 확산 어댑터를 사용하여 추론 속도를 높이는 하이브리드 접근법을 적용했다.

핵심 성능 지표는 다음과 같다:

  • 추론 속도: 최대 5200 tps(tokens per second) 달성
  • 품질 유지: 속도 향상에도 불구하고 성능 손실(lossless)이 없다는 점을 주장(claimed)

해당 모델은 기존 LLM의 구조적 한계를 극복하기 위해 확산 모델을 보조적으로 활용하는 방식을 채택했으며, 관련 연구는 arXiv에 공개되었다.

이 한국어 요약은 AI가 자동으로 만들었습니다. 원문의 주장과 맥락은 원문에서 확인해 주세요. 저작권은 원저작자에게 있습니다.

AI 처리 방식을 확인하거나, 요약 오류와 출처 표기 문제, 삭제 요청을 문의 · 건의로 알려주세요.