AI Briefing

Wafer를 통한 GLM 5.2 Fast, 이제 AI Gateway에서 사용 가능

·2026.06.24 09:00

Vercel AI Gateway에서 Wafer 기반의 고성능 GLM 5.2 Fast 모델을 사용할 수 있게 되었다.

Vercel의 AI Gateway에서 Wafer를 통해 제공되는 GLM 5.2 Fast 모델을 사용할 수 있습니다. 자체 벤치마크 결과, Wafer는 서버리스 환경에서 다른 GLM-5.2 제공업체보다 **2배 높은 처리량(Throughput)**을 기록했습니다.

테스트 결과에 따른 GLM 5.2 Fast의 성능은 다음과 같습니다:

  • Small context: 170+ tok/s
  • Large context: 200+ tok/s

AI Gateway는 모델 호출을 위한 통합 API를 제공하며, 사용량 및 비용 추적, 재시도(Retry), 장애 조치(Failover), 성능 최적화 기능을 통해 높은 가동 시간을 보장합니다. 또한 커스텀 리포팅, Zero Data Retention 지원, API 키별 예산 설정 등의 기능을 포함하고 있습니다.

모든 추론에 대해 추가 마진이나 플랫폼 수수료를 부과하지 않으며, BYOK(Bring Your Own Key) 요청 시에도 제공업체의 가격 정책을 그대로 반영합니다.

이 요약은 원문 이해를 돕기 위한 큐레이션입니다. 저작권은 원저작자에게 있으며, 정확한 내용과 맥락은 원문을 확인하세요.

요약 오류, 출처 표기 문제, 삭제 요청은 문의 · 건의로 알려주세요.