Anthropic, 비용 75% 절감한 Claude Haiku 5.5 출시…노력 설정 도입
핵심 내용
Anthropic이 Haiku 4.5 대비 75% 저렴한 Claude Haiku 5.5를 출시하고 노력 설정을 도입했다.
자세히 보기
Anthropic이 Claude Haiku 5.5를 출시하며 자사 라인업에서 가장 저렴하고 빠르며 성능이 뛰어난 소형 모델임을 강조했습니다. 요약, 데이터베이스 쿼리, 분류 등 대량 처리 및 비용 민감 작업에 최적화되었으며, Opus 5.5 및 Sonnet 5.5와 함께 코딩 작업의 서브 에이전트로도 효과적입니다. 전작인 Haiku 4.5 대비 평균 75% 저렴하며, 10만 토큰 이하 요청의 경우 90%까지 비용이 절감됩니다.
성능 및 벤치마크
Haiku 5.5는 다양한 벤치마크에서 Haiku 4.5를 크게 상회하며, 특정 영역에서는 대형 모델에 근접하거나 이를 초과하는 성능을 보였습니다. 주요 지표는 다음과 같습니다:
- 지식 업무: GDPval-AA v2.1에서 1620점(Haiku 4.5는 735점), AA-Briefcase v1.1에서 1578점(Haiku 4.5는 614점)을 기록했습니다.
- 컴퓨터 사용: OSWorld 2.1(오프라인 하위 집합)에서 **72.4%**를 달성해 Haiku 4.5의 15.7%에서 대폭 향상되었습니다.
- 추론: Humanity’s Last Exam에서 도구 없이 45.9%, 도구 사용 시 **57.4%**를 기록했으며, Haiku 4.5는 각각 10.2%, 18.7%였습니다.
- 에이전트 코딩: Terminal-Bench 4.0에서 39.2%, FrontierCode 1.1(Main)에서 **46.4%**를 기록했습니다.
초기 고객 테스트에서도 이러한 개선이 확인되었습니다. Asana는 지연 시간 30% 감소와 에이전트 턴당 최대 2.5배 빠른 추론을 보고했습니다. HubSpot은 CRM 작업에서 평균 92.8% 점수로 자체 스위트 중 최고 점수와 가장 낮은 오탐지율을 기록했습니다. AlphaSense는 문서 기반 질문의 쿼리 정확도가 통계적으로 유의미하게 개선됨(0.84 vs 0.76)을 관찰했습니다.
신규 기능 및 가격 조정
Haiku 5.5는 Haiku 클래스 최초로 조정 가능한 노력(effort) 설정을 도입해 사용자가 비용과 지능 간 균형을 맞출 수 있게 했습니다. Haiku 5.5의 가격 구조(백만 토큰당)는 다음과 같습니다:
- 입력 토큰: $0.10(10만 토큰 이하) / $0.50(10만 토큰 초과)
- 출력 토큰: $0.50(10만 토큰 이하) / $2.50(10만 토큰 초과)
- 캐시 읽기: $0.01(10만 토큰 이하) / $0.05(10만 토큰 초과)
이번 출시와 함께 Anthropic은 Claude Sonnet 5.5의 캐시 읽기 가격을 절반으로 인하해 백만 토큰당 $0.10으로 조정하며, 에이전트 작업의 전체 비용을 약 20% 절감합니다. 또한 Max 및 Team 구독자에게는 애플리케이션 개발 지원을 위해 월간 API 크레딧(Max 5x $100, Max 20x $200, Team 최대 $500 풀)이 제공됩니다.
가용성 및 안전성
Claude Haiku 5.5는 Amazon Web Services, Google Cloud, Microsoft Azure를 포함한 모든 플랫폼에서 모델 ID claude-haiku-5-5로 즉시 사용 가능합니다. 안전성 평가 결과 정렬(alignment)이 크게 개선되어 비정렬 행동 사례가 줄었습니다. 사이버 보안 가드레일은 Haiku 4.5보다 엄격하지만 Sonnet 5.5보다 더 넓은 범위의 방어적 작업을 허용하며, 침투 테스트는 계속 차단됩니다. 생물학 관련 가드레일은 Sonnet 5 및 Opus 5와 일관됩니다.
이 한국어 요약은 AI가 자동으로 만들었습니다. 원문의 주장과 맥락은 원문에서 확인해 주세요. 저작권은 원저작자에게 있습니다.