AI Briefing

Ornith-1.5 오픈 모델, 397B, 35B, 9B 규모로 출시

·2026.08.20 09:00

핵심 내용

Ornith-1.5가 397B부터 9B까지 다양한 규모의 오픈 모델로 출시되었습니다.

1 / 2

자세히 보기

Ornith는 Ornith-1.5 오픈 모델 시리즈를 공개했습니다. 이번 모델은 이전 버전의 셀프 스캐폴딩 프레임워크를 확장하여, 모델이 스스로 과제를 제안하고 스캐폴드를 생성하며 강화 학습용 솔루션을 도출하는 폐쇄형 자기 개선 루프를 구현했습니다. 출시된 모델은 397B MoE 플래그십, 토큰당 3B 파라미터를 활성화하는 35B MoE, 그리고 iPhone 및 Android용 양자화 모바일 빌드를 포함하는 9B Dense 모델로 구성됩니다.

학습 사이클은 3단계로 진행되며, 모델의 역량을 초과하는 난이도의 과제를 제안하고, 이를 해결하기 위한 스캐폴드를 생성한 후 솔루션 롤아웃을 생성합니다. 보상 신호는 세 단계 전체에 전파되어 더 나은 솔루션, 유용한 학습 과제, 신뢰할 수 있는 평가 하네스를 동시에 학습하도록 합니다. 과제 난이도는 실증 성공률 0.2를 목표로 하며, 유효성 검증을 통과하지 못한 과제는 보상이 0으로 처리됩니다.

벤치마크 결과, Ornith-1.5-397B는 Terminal-Bench 2.1에서 85.1점, DeepSWE에서 56.0점을 기록하며 Claude Opus 4.8과 동급의 성능을 보였습니다. 35B 모델은 Terminal-Bench 2.1에서 68.5점, SWE-Bench Verified에서 79.0점을 달성했으며, 9B 모델은 Gemma 4-31B와 Qwen 3.6-35B를 상회하는 성능을 나타냈습니다. 또한 플래그십 모델은 GPQA Diamond에서 92.8점, BrowseComp에서 86.6점을 기록하며 추론 및 에이전트 작업에서도 뛰어난 성능을 입증했습니다.

이 한국어 요약은 AI가 자동으로 만들었습니다. 원문의 주장과 맥락은 원문에서 확인해 주세요. 저작권은 원저작자에게 있습니다.

AI 처리 방식을 확인하거나, 요약 오류와 출처 표기 문제, 삭제 요청을 문의 · 건의로 알려주세요.