VeriLoop E2 27B 모델, 엄격한 상태 커밋 규칙 적용해 공개
We released VeriLoop E2 (27B, Apache-2.0). The design question behind it: should an LLM be allowed to commit its own state?
핵심 내용
칭화대가 상태 커밋 규칙을 적용한 27B 모델 VeriLoop E2를 공개했다.
자세히 보기
칭화대 SIGS 로봇 연구소가 Qwen3.8-27B를 기반 모델로 Apache-2.0 라이선스로 VeriLoop E2(27B 파라미터)를 공개했다. 이번 릴리스의 핵심은 스칼라 최적화보다 엄격한 비후퇴(non-regression)를 우선시하는 에이전트 상태 관리 설계 규칙인 **VeriLoop-Governed Recurrence (VGR)**이다.
VGR 커밋 규칙
VGR 규칙은 외부 검증된 후보들을 엄격한 진전, 진전 없음, 보호된 후퇴, 비교 불가, 제로 랭크 완료로 분류하여 풍부한 학습 신호를 생성한다. 이러한 범주들은 수정 감독, 최종 생성 대상, 또는 부정적 예시로 사용된다. 검증기는 그래디언트 경로 밖에 위치하여 모델이 더 나은 상태를 제안하되 상태 전환을 스스로 승인하지 않도록 보장한다.
VeriLoop E2는 생성, 추상화, 재계획을 위한 추론자이자 제안자 역할을 한다. 실행, 비교, 롤백은 외부 VeriLoop Harness(비공개)가 관리한다. 저자들은 현재 증거가 Qwen 백본 내 완전한 잠재 상태 통합이 아닌, 궤적 감독을 통한 VGR의 실현을 뒷받침한다고 명확히 했다.
가용성 및 사양
- 가중치: Apache-2.0 라이선스로 Hugging Face에서 제공됨.
- 서빙: vLLM 0.17.0에서 BF16 정밀도, 131K 컨텍스트 길이로 검증됨(토크나이저 기본 최대값: 262K).
- 양자화: 공식 GGUF 파일은 BF16부터 IQ1_M까지 제공된다. Q6_K(20.6 GiB)를 권장한다. 양자화 명칭이 표준 llama.cpp 관례와 다르므로 파일 크기로 비교해야 한다.
- 하드웨어: 가장 작은 메인 파일은 16.8 GiB로, 16 GB VRAM 이상의 카드가 필요하다.
- 평가: 태스크별 기록은 공개되지만, 독점 하네스 없이 측정된 독립적인 성능 수치는 아직 발표되지 않았다.
이 한국어 요약은 AI가 자동으로 만들었습니다. 원문의 주장과 맥락은 원문에서 확인해 주세요. 저작권은 원저작자에게 있습니다.