AI Briefing

CLM-v0.1-8B: LLM 추론 속도 9배 단축, 에이전트 검증 SOTA 달성

Contrastive-LM/CLM-v0.1-8B

·2026.09.27 02:52

Qwen3-8B 인코더 위에 상태와 행동을 연결하는 두 개의 투영 헤드를 얹어, 복잡한 추론 없이 즉각적인 의사결정을 내리는 System One 모델이다. 생성형 LLM이 답을 만들어내는 대신, 주어진 후보군 중 최적의 선택지를 점수화하여 랭킹하는 방식이라 지연 시간을 크게 줄인다.

컴퓨터 사용, 게임, 도구 호출 등 에이전트 태스크에서 Jev 모델과 동등한 성능을 보이면서도 지연 시간은 최대 9배 낮다. 특히 DeepSWE와 Terminal-Bench 2.1 벤치마크에서 파인튜닝된 검증기(Verifier)로 각각 81.6%, 87.6%의 SOTA 점수를 기록하며 기존 대비 4~6배 빠른 처리 속도를 입증했다.

상태와 행동을 별도로 인코딩하는 캐싱 구조를 채택해, 약 1,000개의 후보를 평가할 때 Jev보다 13배 빠르다. 고객 문의 분류나 다음 행동 선택처럼 반복적인 의사결정이 필요한 에이전트 워크플로우에서 경량화된 추론 엔진으로 활용하기 적합하다.

HuggingFace
HuggingFace 모델

Contrastive-LM/CLM-v0.1-8B

원문에 등록된 설명이 없습니다.

text-ranking

이 한국어 소개글은 AI가 자동으로 만들었습니다. 원문의 주장과 맥락은 원문에서 확인해 주세요. 저작권은 원저작자에게 있습니다.

AI 처리 방식을 확인하거나, 소개 오류와 출처 표기 문제, 삭제 요청을 문의 · 건의로 알려주세요.