AI Briefing

Transformers.js v4 공개

·2026.03.31 09:00

Transformers.js v4가 WebGPU 백엔드를 도입하여 브라우저와 서버 환경에서 고성능 AI 모델 실행을 지원한다.

Transformers.js v4가 NPM을 통해 정식 출시되었다. 이번 버전의 가장 큰 변화는 C++로 완전히 재작성된 새로운 WebGPU Runtime의 도입이다.

새로운 런타임은 ONNX Runtime 팀과의 협업을 통해 최적화되었으며, 브라우저뿐만 아니라 Node, Bun, Deno와 같은 다양한 JavaScript 환경에서도 WebGPU 가속을 지원한다.

성능 극대화를 위해 새로운 모델 내보내기(export) 전략을 채택했다. 특히 com.microsoft.MultiHeadAttention과 같은 특화된 ONNX Runtime Contrib Operators를 활용하여, BERT 기반 임베딩 모델에서 약 4배의 속도 향상을 달성했다.

지원 모델과 아키텍처도 대폭 확대되었다.

  • GPT-OSS, GraniteMoeHybrid, Olmo3 등 최신 모델 지원
  • Mamba(SSM), MLA, MoE 등 고급 아키텍처 구현
  • 8B 파라미터를 초과하는 대규모 모델 실행 지원

이 요약은 원문 이해를 돕기 위한 큐레이션입니다. 저작권은 원저작자에게 있으며, 정확한 내용과 맥락은 원문을 확인하세요.

요약 오류, 출처 표기 문제, 삭제 요청은 문의 · 건의로 알려주세요.