AI Briefing

gpt-oss 소개

·2025.08.05 09:00

OpenAI가 강력한 추론 성능과 효율적인 배포를 지원하는 오픈 웨이트 모델 gpt-oss를 공개했다.

OpenAI가 강력한 추론 성능과 저렴한 비용을 자랑하는 오픈 웨이트 언어 모델인 gpt-oss-120bgpt-oss-20b를 출시했다. Apache 2.0 라이선스로 제공되는 이 모델들은 o3와 같은 최첨단 프론티어 모델의 기술과 강화 학습(RL)을 결합하여 학습되었으며, 소비자용 하드웨어에서도 효율적으로 구동되도록 최적화되었다.

gpt-oss-120b는 핵심 추론 벤치마크에서 OpenAI o4-mini와 대등한 성능을 보이며, 단일 80GB GPU에서 효율적으로 실행된다. gpt-oss-20bo3-mini와 유사한 성능을 내면서도 16GB 메모리만으로 에지 디바이스에서 구동이 가능해 로컬 추론 및 빠른 반복 작업에 이상적이다. 두 모델 모두 도구 사용(Tool use), CoT(Chain-of-Thought) 추론, HealthBench 등에서 뛰어난 성능을 입증했다.

이 모델들은 Responses API와 호환되며, 웹 검색이나 Python 코드 실행과 같은 에이전트 워크플로우 내에서 탁월한 지시 이행 능력을 발휘한다. 또한 Structured Outputs를 지원하며, 작업의 복잡도에 따라 추론 노력(Reasoning effort)을 조절하여 지연 시간을 최적화할 수 있다.

아키텍처 측면에서는 **Mixture-of-Experts (MoE)**를 채택하여 연산 효율을 극대화했다. gpt-oss-120b는 총 117B 파라미터 중 토큰당 5.1B를 활성화하며, gpt-oss-20b는 총 21B 중 3.6B를 활성화한다. RoPEGrouped Multi-Query Attention을 사용하며, 최대 128k의 컨텍스트 길이를 지원한다.

이 요약은 원문 이해를 돕기 위한 큐레이션입니다. 저작권은 원저작자에게 있으며, 정확한 내용과 맥락은 원문을 확인하세요.

요약 오류, 출처 표기 문제, 삭제 요청은 문의 · 건의로 알려주세요.