AI Briefing
추천

Anthropic, Claude Opus 5.5 공개… 비용 40% 절감 및 역대 최고 정렬 점수 기록

·2026.09.23 02:43

핵심 내용

Claude Opus 5.5가 Opus 5 대비 실행 비용 40%를 절감하고 역대 최고 정렬 점수를 달성하며 공개됐다.

자세히 보기

Anthropic이 Claude Opus 5.5를 공개했다. 이 모델은 전작인 Opus 5 대비 기본 설정에서 일반적인 워크로드의 실행 비용을 40% 절감한다. 입력 가격은 $4/M, 출력은 $20/M로 Opus 5보다 20% 낮아졌으며, 캐시 읽기 비용은 60% 인하된 $0.20/M이다. 출력 생성 속도는 30% 이상 빨라졌다.

성능 및 벤치마크

Opus 5.5는 agentic coding, computer use, knowledge work 벤치마크에서 1위를 차지했다. 주요 지표로는 Terminal-Bench 4.0 66.4%, FrontierCode 54.4%, GDPval-AA Elo 1846 등을 기록했다. 특히 Medium effort 모드에서 GPT-6 Astra의 max effort 대비 비용은 약 1/5 수준이면서 성능은 우월한 것으로 나타났다. 실제 테스트에서는 Opus 5의 high effort와 동일한 성능을 내면서 출력 토큰을 20~25% 적게 사용했다.

정렬 및 안전성 평가

외부 평가와 자동 행동 감사에서 역대 최고 정렬 점수를 기록했다. 약 2,000개 시나리오 감사에서 최근 Claude 모델 중 가장 낮은 비정렬 행동 점수를 보였으며, 신규 컨테이너 경계 테스트에서의 우회 시도 빈도는 Opus 5 대비 약 85% 감소했다. 생물학 및 사이버보안 능력은 Claude Mythos 5.1과 유사한 수준으로 평가되어, Fable 5.1과 동일한 Life Sciences/Cyber Verification Program 안전장치가 적용된다. 프롬프트 인젝션 저항성은 Opus 5보다 높으며, Gray Swan 벤치마크에서 Fable 5.1과 함께 최저 인젝션 성공률을 기록했다.

배포

해당 모델은 AWS, Google Cloud, Microsoft Azure 등 모든 플랫폼에서 배포되며, Claude Platform에서는 claude-opus-5-5 모델 ID로 접근 가능하다. 검증된 조직은 Life Sciences Verification Program을 통해 생물학 연구에, 사이버보안 실무자는 Cyber Verification Program을 통해 해당 모델을 사용할 수 있다.

이 한국어 요약은 AI가 자동으로 만들었습니다. 원문의 주장과 맥락은 원문에서 확인해 주세요. 저작권은 원저작자에게 있습니다.

AI 처리 방식을 확인하거나, 요약 오류와 출처 표기 문제, 삭제 요청을 문의 · 건의로 알려주세요.