Wafer를 통한 GLM 5.2 Fast, 이제 AI Gateway에서 사용 가능
·2026.06.24 09:00
핵심 내용
Vercel AI Gateway에서 Wafer 기반의 고성능 GLM 5.2 Fast 모델을 사용할 수 있게 되었다.
자세히 보기
Vercel의 AI Gateway에서 Wafer를 통해 제공되는 GLM 5.2 Fast 모델을 사용할 수 있습니다. 자체 벤치마크 결과, Wafer는 서버리스 환경에서 다른 GLM-5.2 제공업체보다 **2배 높은 처리량(Throughput)**을 기록했습니다.
테스트 결과에 따른 GLM 5.2 Fast의 성능은 다음과 같습니다:
- Small context: 170+ tok/s
- Large context: 200+ tok/s
AI Gateway는 모델 호출을 위한 통합 API를 제공하며, 사용량 및 비용 추적, 재시도(Retry), 장애 조치(Failover), 성능 최적화 기능을 통해 높은 가동 시간을 보장합니다. 또한 커스텀 리포팅, Zero Data Retention 지원, API 키별 예산 설정 등의 기능을 포함하고 있습니다.
모든 추론에 대해 추가 마진이나 플랫폼 수수료를 부과하지 않으며, BYOK(Bring Your Own Key) 요청 시에도 제공업체의 가격 정책을 그대로 반영합니다.
이 한국어 요약은 AI가 자동으로 만들었습니다. 원문의 주장과 맥락은 원문에서 확인해 주세요. 저작권은 원저작자에게 있습니다.