AI Briefing

Jalapeño 첫 결과, AI 추론에서 업계 최고 속도 및 효율 입증

·2026.08.25 16:00

핵심 내용

OpenAI의 자체 추론 칩 Jalapeño가 전력 대비 성능과 지연 시간에서 기존 시스템을 크게 앞지른 것으로 확인됐다.

자세히 보기

OpenAI가 자체 개발한 첫 번째 추론 칩 Jalapeño의 초기 성능 테스트 결과를 공개했다. Jalapeño는 단일 아키텍처로 기존 하드웨어 시스템에서 타협해야 했던 **처리량(throughput)**과 **지연 시간(latency)**을 동시에 개선하는 성과를 보였다.

GPT-OSS 120B, DeepSeek R1, Kimi K2.5 1T 등 다양한 모델을 대상으로 한 테스트에서 Jalapeño는 피크 처리량 시 전력당 AI 작업량이 1.5~1.9배 높고, 끝에서 끝까지의 지연 시간이 1.7~3.6배 짧았다. 특히 대화형 워크로드에서는 2.1~4.1배 높은 성능을 기록했다.

성능 평가는 SemiAnalysis의 공개 벤치마크 InferenceX를 활용해 사용자 경험 수준을 일치시킨 상태에서 수행했다. Jalapeño는 700W로 평가받았으나, 실제 테스트 워크로드에서는 550W 이하의 지속 전력으로 작동했다. OpenAI는 Jalapeño가 모델부터 칩, 메모리, 네트워크까지 풀스택을 통합 설계한 결과물이며, 향후 더 빠르고 효율적인 제품으로 확장될 것이라고 밝혔다.

이 한국어 요약은 AI가 자동으로 만들었습니다. 원문의 주장과 맥락은 원문에서 확인해 주세요. 저작권은 원저작자에게 있습니다.

AI 처리 방식을 확인하거나, 요약 오류와 출처 표기 문제, 삭제 요청을 문의 · 건의로 알려주세요.