AI Briefing

풍부한 지능 구축

·2026.08.01 00:00

OpenAI가 AI 비용을 낮추고 인프라부터 제품까지 효율을 높이는 전략을 제시했다.

OpenAI는 고도화된 AI를 더 저렴하고 폭넓게 활용할 수 있도록 만드는 ‘풍부한 지능’ 전략을 제시했다. 유용한 지능의 비용이 낮아지면 더 많은 작업이 경제성을 확보하고, 사용 확대가 다시 연구·인프라 투자와 모델 개선으로 이어진다는 구상이다.

최근 가격 조정으로 GPT-5.6 Luna의 가격은 입력 토큰 100만 개당 0.20달러, 출력 토큰 100만 개당 1.20달러로 80% 낮아졌다. GPT-5.6 Terra는 입력 2달러, 출력 12달러로 20% 인하됐으며, GPT-5.6 Sol의 Fast 모드는 표준 처리보다 최대 2.5배 빠른 대신 두 배의 비용이 든다.

OpenAI는 단순한 토큰 가격보다 성공적인 결과를 얻는 데 드는 전체 비용이 중요하다고 설명했다. 반복 시도, 사람의 감독, 오류 수정까지 고려하면 더 강력한 모델이 저렴한 모델보다 경제적일 수 있으며, 반대로 낮은 비용의 모델은 동일한 품질을 유지하면서 AI 접근성을 넓힐 수 있다.

컴퓨팅 효율을 높이기 위해 모델뿐 아니라 시스템 전반도 개선하고 있다. GPT-5.6 Sol은 모델 서비스에 사용되는 운영 소프트웨어를 최적화해 전체 서빙 비용을 20% 줄였고, speculative decoding 개선으로 토큰 생성 효율을 15% 이상 높였다.

라우팅, 컨텍스트 관리, 도구, 제품 설계도 핵심 요소로 꼽혔다. 특히 retained reasoning과 컨텍스트 관리 방식을 개선한 결과, 모델 변경 없이 ARC-AGI-3 공개 과제 점수를 13.3%에서 38.3%로 높이면서 출력 토큰 사용량은 6분의 1로 줄였다.

OpenAI는 인프라, 모델, 플랫폼, 제품을 모두 구축하는 풀스택 접근법이 각 계층을 서로 개선한다고 강조했다. ChatGPT, ChatGPT Work, Codex, API에서 얻는 실제 사용 데이터와 수요가 연구 방향과 설비 투자 결정을 뒷받침하고, 개선된 연구 결과는 다시 제품 성능과 서비스 비용을 낮추는 구조다.

이 요약은 원문 이해를 돕기 위한 큐레이션입니다. 저작권은 원저작자에게 있으며, 정확한 내용과 맥락은 원문을 확인하세요.

요약 오류, 출처 표기 문제, 삭제 요청은 문의 · 건의로 알려주세요.