Claude Opus 4.7
핵심 내용
Anthropic이 Opus 4.6을 넘는 Claude Opus 4.7을 일반 공개했다.
자세히 보기
Anthropic이 Claude Opus 4.7을 일반 공개(GA) 했다.
핵심 변화는 고난도 소프트웨어 엔지니어링, 장기 실행 작업, 지시 준수, 자체 검증 능력의 개선이다. 이전보다 더 복잡한 코딩 작업을 감독 부담 없이 맡길 수 있다고 설명하며, 오래 걸리는 멀티스텝 작업에서도 일관성과 정확성이 좋아졌다고 강조한다.
멀티모달 성능도 강화됐다. 특히 고해상도 이미지를 더 잘 읽으며, 긴 변의 길이 2,576px까지 입력을 받을 수 있다. 이로 인해 밀도 높은 스크린샷, 복잡한 다이어그램, 정밀한 컴퓨터 사용 작업에서 유리해졌다고 한다. 프로페셔널 문서, 슬라이드, UI 생성에서는 더 취향이 좋고 창의적인 결과를 낸다고 소개한다.
벤치마크와 실사용 평가에서도 Opus 4.6 대비 개선이 확인됐다.
- 93-task coding benchmark에서 해결률이 13% 상승했고, Opus 4.6과 Sonnet 4.6이 못 푼 과제 4개를 추가로 해결했다.
- 내부 research-agent benchmark에서는 6개 모듈 합산 0.715로 최고 수준의 효율을 보였고, 특히 General Finance는 0.813 vs 0.767로 향상됐다.
- 금융, 법률, 문서 분석, 긴 컨텍스트 추론, 도구 사용, 코드리뷰 등 여러 파트너 평가에서 더 낮은 오류율, 더 좋은 추적성, 더 적은 tool error가 보고됐다.
안전성 측면에서는 Opus 4.6과 유사한 프로파일을 유지하면서도, 일부 항목에서는 더 좋아졌고 일부에서는 약간 약해졌다고 설명한다. 특히 사이버 보안 악용 가능성에 대해서는 자동 탐지·차단 가드레일을 적용했으며, 합법적 보안 연구자는 Cyber Verification Program에 참여할 수 있다. 이런 배포 경험은 향후 더 강한 Mythos-class 모델의 공개를 위한 사전 단계로 제시된다.
출시 조건도 명확하다. Claude 제품 전반, API, Amazon Bedrock, Google Cloud Vertex AI, Microsoft Foundry에서 바로 사용할 수 있고, 가격은 Opus 4.6과 동일하게 입력 100만 토큰당 $5, 출력 100만 토큰당 $25다. API 모델명은 claude-opus-4-7이다.
이 한국어 요약은 AI가 자동으로 만들었습니다. 원문의 주장과 맥락은 원문에서 확인해 주세요. 저작권은 원저작자에게 있습니다.