AI Briefing

중국텔레콤, Ascend NPU 기반 MoE 모델 공개

XingChen-AGI/Xing4.0-29B-A4B MoE

·2026.09.17 15:46

핵심 내용

중국텔레콤이 Ascend NPU에서 훈련된 29B MoE 모델 Xing4.0-29B-A4B를 공개했다.

자세히 보기

중국텔레콤 AI 기술 유한회사가 차세대 대규모 언어 모델 Xing4.0-29B-A4B를 공개했다. 이 모델은 총 29B 파라미터 중 토큰당 4B만 활성화되는 MoE 구조를 채택했으며, 256K 기본 컨텍스트 길이를 지원하고 512K까지 확장 가능하다.

Ascend NPU 최적화 및 성능

이 모델은 Ascend NPU 플랫폼과 MindSpore 프레임워크를 사용하여 완전히 훈련된 최초의 해당 규모 모델이다. Ascend 910C 클러스터에 맞춰 mHC 및 MLA 아키텍처를 적응시키고 융합 연산자 개발을 통해, 기본 성능 대비 훈련 처리량을 약 96% 향상시켰다.

에이전트 지향 아키텍처 및 벤치마크

mHC, MLA, MTP 아키텍처를 기반으로 다단계 계획, 도구 호출 및 복잡한 추론 체인 실행을 지원하여 긴 컨텍스트에서의 작업 일관성을 보장한다. 벤치마크 결과 SWE-bench Verified에서 75.00점, AIME2026에서 90.00점을 기록하며 경쟁 모델 대비 높은 성능을 보였다.

이 한국어 요약은 AI가 자동으로 만들었습니다. 원문의 주장과 맥락은 원문에서 확인해 주세요. 저작권은 원저작자에게 있습니다.

AI 처리 방식을 확인하거나, 요약 오류와 출처 표기 문제, 삭제 요청을 문의 · 건의로 알려주세요.