Claude Opus 4.6 공개
핵심 내용
코딩·장문 컨텍스트·안전성을 강화한 Claude Opus 4.6이 출시됐다.
자세히 보기
Claude Opus 4.6이 코딩 성능을 크게 끌어올린 최신 모델로 공개됐다. 더 정교하게 계획하고, 에이전트 작업을 더 오래 유지하며, 대형 코드베이스에서 더 안정적으로 동작하고, 코드 리뷰와 디버깅 능력도 강화됐다. Opus급 모델로는 처음으로 1M token context window가 beta로 제공된다.
성능도 여러 벤치마크에서 선두권이다. Terminal-Bench 2.0에서 최고 점수를 기록했고, Humanity’s Last Exam에서도 선두를 차지했다. GDPval-AA에서는 OpenAI의 GPT-5.2보다 약 144 Elo 앞섰고, 전작 Claude Opus 4.5보다 190 Elo 높았다. BrowseComp에서도 다른 어떤 모델보다 뛰어난 결과를 냈다.
장문 작업에서는 더 많은 문서를 오래 추적하면서 핵심 정보를 놓치지 않는다. Anthropic은 MRCR v2의 8-needle 1M 변형에서 Opus 4.6이 76%, Sonnet 4.5가 **18.5%**를 기록했다고 밝혔다. 이를 통해 긴 컨텍스트에서의 정보 검색과 그 이후의 추론이 모두 개선됐다고 설명한다.
안전성도 함께 강화됐다. 자동 행동 감사에서 기만, 아첨, 사용자 망상 조장, 오남용 협조 같은 misaligned behavior 비율이 낮았고, 최근 Claude 모델 중 가장 낮은 over-refusal 비율도 보였다. 새 버전에서는 사용자 웰빙, 위험 요청 거절, 은밀한 유해 행위 탐지 등 더 넓은 범위의 평가를 적용했다.
제품과 API도 함께 업데이트됐다. Claude Code에는 여러 에이전트를 병렬로 돌리는 agent teams가 추가됐고, API에는 compaction, adaptive thinking, effort 제어가 들어갔다. Claude in Excel은 대폭 개선됐고, Claude in PowerPoint는 research preview로 공개됐다. Opus 4.6은 claude.ai, API, 주요 클라우드 플랫폼에서 바로 사용할 수 있으며, 가격은 $5/$25 per million tokens로 유지된다.
이 한국어 요약은 AI가 자동으로 만들었습니다. 원문의 주장과 맥락은 원문에서 확인해 주세요. 저작권은 원저작자에게 있습니다.