AI Briefing

R9700 Ngram-Mod 속도 테스트

Brief Ngram-Mod Test Results - R9700/Qwen3.6 27B

·2026.04.27 13:12

핵심 내용

R9700에서 Qwen3.6 27B ngram-mod 적용 시 변동성은 있지만 속도 향상을 보였다.

자세히 보기

AMD Radeon AI PRO R9700에서 llama.cpp의 --spec-type ngram-mod를 적용해 Qwen3.6 27B를 테스트했다.

  • llama-bench-vulkan 기준 pp512 1050.13 t/s, tg128 31.26 t/s를 기록했다.
  • llama-server-vulkan은 --spec-ngram-size-n 24, --draft-min 12, --draft-max 48 등의 설정으로 구동했다.
  • 토큰 생성 속도는 평균 28.80 t/s, 중앙값 28.20 t/s, P95 45.34 t/s로 나타났다.
  • 프롬프트 처리 속도는 평균 549.60 t/s, 중앙값 519.19 t/s, P95 936.60 t/s였다.
  • 작성자는 성능 변동성은 있지만, 같은 코드베이스를 다루는 작업에서는 속도 증가가 유용했다고 정리했다.

이 한국어 요약은 AI가 자동으로 만들었습니다. 원문의 주장과 맥락은 원문에서 확인해 주세요. 저작권은 원저작자에게 있습니다.

AI 처리 방식을 확인하거나, 요약 오류와 출처 표기 문제, 삭제 요청을 문의 · 건의로 알려주세요.