AI Briefing

마이크로소프트의 새로운 MAI-Image 및 MAI-Voice 공개

·2026.07.24 09:00

마이크로소프트가 고성능 이미지 생성 모델과 고속 음성 모델을 포함한 새로운 MAI 모델 라인업을 공개했다.

마이크로소프트 AI가 자체 개발한 목적 기반 모델인 MAI-Image-2.5-ProMAI-Voice-2-Flash를 공개했다. 이 모델들은 외부 모델의 증류(distillation) 없이 기업급 데이터를 기반으로 처음부터 설계되었다.

MAI-Image-2.5-Pro는 고품질 이미지 생성과 정밀한 텍스트 렌더링, 자연어 편집 기능을 제공하며 현재 퍼블릭 프리뷰 단계다. 고해상도 이미지와 정교한 편집이 필요한 크리에이티브 작업에 최적화되어 있다.

MAI-Voice-2-Flash는 속도와 규모에 초점을 맞춘 모델로, 기존 MAI-Voice-2 대비 2배 빠른 속도32% 저렴한 비용을 자랑한다. 응답성이 중요한 대규모 음성 서비스 환경에 적합하다.

이 모델들은 Bing, PowerPoint, OneDrive, Azure 등 마이크로소프트의 주요 제품군에 통합되어 사용되며, 특히 Bing Image Creator는 이제 MAI-Image-2.5를 기본 모델로 사용하여 엔드 투 엔드(end-to-end)로 구동된다.

이 요약은 원문 이해를 돕기 위한 큐레이션입니다. 저작권은 원저작자에게 있으며, 정확한 내용과 맥락은 원문을 확인하세요.

요약 오류, 출처 표기 문제, 삭제 요청은 문의 · 건의로 알려주세요.