R9700 Ngram-Mod 속도 테스트
Brief Ngram-Mod Test Results - R9700/Qwen3.6 27B
·2026.04.27 13:12
핵심 내용
R9700에서 Qwen3.6 27B ngram-mod 적용 시 변동성은 있지만 속도 향상을 보였다.
자세히 보기
AMD Radeon AI PRO R9700에서 llama.cpp의 --spec-type ngram-mod를 적용해 Qwen3.6 27B를 테스트했다.
llama-bench-vulkan기준 pp512 1050.13 t/s, tg128 31.26 t/s를 기록했다.llama-server-vulkan은--spec-ngram-size-n 24,--draft-min 12,--draft-max 48등의 설정으로 구동했다.- 토큰 생성 속도는 평균 28.80 t/s, 중앙값 28.20 t/s, P95 45.34 t/s로 나타났다.
- 프롬프트 처리 속도는 평균 549.60 t/s, 중앙값 519.19 t/s, P95 936.60 t/s였다.
- 작성자는 성능 변동성은 있지만, 같은 코드베이스를 다루는 작업에서는 속도 증가가 유용했다고 정리했다.
이 한국어 요약은 AI가 자동으로 만들었습니다. 원문의 주장과 맥락은 원문에서 확인해 주세요. 저작권은 원저작자에게 있습니다.