AI Briefing

GPT-5.5 공개

·2026.04.24 04:00

GPT-5.5가 코딩·지식노동·과학 연구를 더 빠르고 효율적으로 처리하는 새 모델로 공개됐다.

GPT-5.5는 코딩, 온라인 리서치, 데이터 분석, 문서·스프레드시트 작성, 소프트웨어 조작까지 맡길 수 있는 실무형 모델로 공개됐다. 복잡한 다단계 작업을 넘겨도 스스로 계획하고 도구를 사용하며, 확인과 수정까지 이어가도록 설계됐다.

특히 agentic coding, 컴퓨터 사용, 지식 노동, 초기 과학 연구에서 향상이 두드러진다. GPT-5.4와 비슷한 per-token latency를 유지하면서 더 높은 지능을 내고, Codex 작업에서는 같은 일을 더 적은 토큰으로 끝내 효율도 높였다. Artificial Analysis의 Coding Index에서도 경쟁 프론티어 코딩 모델의 절반 비용 수준으로 최고 수준 성능을 보인다고 설명한다.

안전 배포를 위해 역대 가장 강한 가드레일을 적용했다. 내부·외부 red team 검증, 사이버보안과 생물학에 대한 추가 테스트, 약 200개의 초기 접근 파트너 피드백을 거쳐 공개를 준비했다. 롤아웃은 Plus·Pro·Business·EnterpriseChatGPTCodex에서 시작됐고, GPT-5.5 Pro는 ChatGPT의 Pro·Business·Enterprise로 먼저 배포된다. API 버전은 별도 안전 요건을 맞춘 뒤 곧 제공될 예정이다.

  • 코딩: Terminal-Bench 2.0 82.7%, SWE-Bench Pro 58.6%, Expert-SWE 73.1%, CyberGym 81.8%
  • 지식·업무: GDPval **84.9%**로 승리 또는 동률, OSWorld-Verified 78.7%, Tau2-bench Telecom 98.0%(prompt tuning 없이), FinanceAgent 60.0%, 내부 투자은행 모델링 과제 88.5%, OfficeQA Pro 54.1%
  • 추가 비교: BrowseComp 84.4%(Pro 90.1%), FrontierMath Tier 1–3 51.7%(Pro 52.4%), FrontierMath Tier 4 35.4%(Pro 39.6%)

실사용 사례도 구체적이다. OpenAI 내부의 85% 이상이 매주 Codex를 사용하고 있으며, 커뮤니케이션팀의 요청 분류 자동화, Finance의 24,771개 K-1 세무서류(71,637페이지) 검토, GTM 팀의 주간 리포트 자동화에 활용됐다. GPT-5.5 Thinking은 더 빠르고 간결한 고난도 답변을 제공하고, GPT-5.5 Pro는 비즈니스, 법률, 교육, 데이터 사이언스 작업에서 더 포괄적이고 정확한 결과를 낸다.

과학 연구에서는 GeneBenchBixBench에서 개선을 보였고, 내부 하네스에서는 Ramsey numbers에 대한 새로운 증명을 찾는 데도 기여했다.

이 요약은 원문 이해를 돕기 위한 큐레이션입니다. 저작권은 원저작자에게 있으며, 정확한 내용과 맥락은 원문을 확인하세요.

요약 오류, 출처 표기 문제, 삭제 요청은 문의 · 건의로 알려주세요.