AI Briefing

Anthropic, Claude Sonnet 5.5 공개… 에이전틱 코딩 성능 대폭 향상 및 비용 효율 강화

·2026.09.28 09:00

핵심 내용

Claude Sonnet 5.5, Terminal-Bench 70.6% 달성하며 가격 유지 및 비용 30% 절감했다

1 / 3

자세히 보기

Anthropic이 Claude 5.5 시리즈의 두 번째 모델인 Claude Sonnet 5.5를 공개했다. 이 모델은 Opus 5.5의 빠르고 비용 효율적인 보완재로, 복잡한 판단이 필요한 작업은 Opus 5.5가 담당하고 Sonnet 5.5는 명확한 일상 업무, 버그 수정, 문서 생성에 최적화됐다. 고빈도 저비용 변형인 Claude Haiku 5.5는 수 주 내 출시 예정이다.

성능 벤치마크

Sonnet 5.5는 주요 벤치마크에서 Sonnet 5 대비 큰 폭의 성능 향상을 보였으며, 더 낮은 비용으로 Opus 5.5에 근접한 결과를 냈다:

  • Terminal-Bench 4.0 (에이전틱 코딩): 70.6% 기록. Sonnet 5의 10.3%에서 대폭 상승했으며, Opus 5.5는 66.4%를 기록했다.
  • GDPval-AA v2.1 (지식 업무): 1844점 획득. Opus 5.5의 1846점에 거의 근접했고, Sonnet 5의 1449점을 상회했다.
  • OSWorld 2.1 (컴퓨터 사용): 80.1% 달성. Sonnet 5의 57.0%에서 개선됐으며, Opus 5.5는 81.8%였다.
  • Chartography (시각 차트 인식): 61.6% 기록. Sonnet 5의 15.6%에서 극적으로 상승했다.
  • FrontierCode 1.1: Xhigh 설정에서 52.1% 기록. Sonnet 5의 42.4% 대비 향상됐다.
  • Pokémon Red: 스크린샷만으로 게임을 클리어한 최초의 Sonnet 모델이 됐다.

비용 및 속도 효율

가격은 Sonnet 5와 동일하다(입력 100만 토큰당 $2, 출력 100만 토큰당 $10). 그러나 토큰 사용량 감소로 작업 비용이 최대 30% 절감된다. 출력 생성 속도는 Sonnet 5보다 30% 이상 빨라 역대 Sonnet 모델 중 가장 빠르다. Low/Medium 설정에서는 Sonnet 5의 최고 점수를 작업당 약 1/10 비용으로 달성한다.

안전성 및 가드레일

Sonnet 5.5는 사이버 보안과 추론 추출 방지 등 강화된 안전 조치를 도입했다:

  • 사이버 보안: Opus 5.5와 유사한 가드레일을 갖춘 Opus 5급 기능을 제공한다. 고위험 사이버 작업은 Sonnet 5로 폴백되며, 고급 접근 권한은 Cyber Verification Program을 통해 제공된다.
  • 증류 방지: 추론 추출을 방지하는 안전 분류기를 탑재한 최초의 Sonnet 모델로, 사고 과정이 계정과 분리되도록 보장한다.
  • 생물학: Sonnet 5 수준의 가드레일을 유지하며, 고위험 요청만 차단하고 대부분의 연구 및 임상 작업은 허용한다.

기업 피드백

초기 테스트 사용자들은 상당한 운영 개선을 보고했다:

  • 초기 테스트 사용자: 118개 앱 빌드에서 Opus 5와 동등한 점수를 달성했으며, 반복 횟수는 Opus 5의 7.7회 대비 3.6회로 줄었다.
  • 초기 테스트 사용자: 티켓 처리 속도가 20% 향상되고 오결정 건수가 감소했다.
  • Balyasny Asset Management: 금융 작업에서 답변당 약 121k 토큰을 사용했으며, Sonnet 5의 497k 토큰 대비 효율적이다.
  • 초기 테스트 사용자: 속도가 2.4배 빨라지고 총 토큰 사용량이 12% 감소했다고 보고했다.

이 모델은 AWS, Google Cloud, Microsoft Azure에서 모델명 claude-sonnet-5-5로 제공되며, Zero Data Retention 옵션을 지원한다.

이 한국어 요약은 AI가 자동으로 만들었습니다. 원문의 주장과 맥락은 원문에서 확인해 주세요. 저작권은 원저작자에게 있습니다.

AI 처리 방식을 확인하거나, 요약 오류와 출처 표기 문제, 삭제 요청을 문의 · 건의로 알려주세요.