GPT-5.3-Codex-Spark 공개
·2026.02.12 19:00
OpenAI가 Cerebras와 협력하여 초당 1,000개 이상의 토큰을 생성하는 실시간 코딩 모델 GPT-5.3-Codex-Spark를 공개했다.
OpenAI가 실시간 코딩에 최적화된 소형 모델인 GPT-5.3-Codex-Spark의 리서치 프리뷰를 공개했다. 이 모델은 Cerebras와의 파트너십을 통해 개발되었으며, 초당 1,000개 이상의 토큰을 생성하며 실시간에 가까운 응답 속도를 제공한다.
Codex-Spark는 대규모 작업을 수행하는 기존 모델과 달리, 실시간으로 코드를 수정하고 로직을 재구성하는 등 즉각적인 상호작용에 특화되어 있다. 128k 컨텍스트 윈도우를 지원하며, SWE-Bench Pro 및 Terminal-Bench 2.0 벤치마크에서 강력한 성능을 입증했다.
또한, 전체 요청-응답 파이프라인의 지연 시간을 줄이기 위해 다음과 같은 기술적 개선을 도입했다:
- WebSocket 연결 도입 및 Responses API 최적화
- 클라이언트/서버 라운드트립 오버헤드 80% 감소
- 토큰당 오버헤드 30% 감소 및 첫 토큰 생성 시간(TTFT) 50% 단축
이 모델은 Cerebras의 Wafer Scale Engine 3 가속기에서 구동된다. GPU가 광범위한 사용에 비용 효율적이라면, Cerebras는 극도로 낮은 지연 시간이 필요한 워크플로우를 보완하여 최적의 성능을 구현한다.
현재 ChatGPT Pro 사용자를 대상으로 Codex 앱, CLI, VS Code 확장 프로그램에서 리서치 프리뷰 형태로 제공된다.
이 요약은 원문 이해를 돕기 위한 큐레이션입니다. 저작권은 원저작자에게 있으며, 정확한 내용과 맥락은 원문을 확인하세요.
요약 오류, 출처 표기 문제, 삭제 요청은 문의 · 건의로 알려주세요.