llama.cpp, Vulkan 백엔드 및 신규 모델 지원 업데이트
llama.cpp updates - granite-speech-4.1-2b, LFM2.5-ColBERT/Embedding-350M, Vulkan backend related changes & Misc items
·2026.06.24 18:37
llama.cpp가 Vulkan 백엔드 성능 개선과 Granite, LFM2.5 등 신규 모델 지원을 포함한 업데이트를 실시했습니다.
llama.cpp의 최신 업데이트를 통해 다음과 같은 주요 변경 사항이 적용되었습니다.
신규 모델 지원
- granite-speech-4.1-2b-plus 지원
- LFM2.5-ColBERT-350M 및 LFM2.5-Embedding-350M 지원
Vulkan 백엔드 개선
- CONV_3D 지원 및 GET_ROWS_BACK 기능 추가
- SQR, SQRT, SIN, COS, CLAMP, LEAKY_RELU, NORM 등 다양한 백엔드 테스트 지원
- Softmax 적용 전 Bias를 적용하여 오버플로(overflow) 방지
- Vulkan 관련 최적화 및 버그 수정
기타 사항
- UI 로고 교체, 내비게이션 정리 및 모바일 UI/UX 개선이 포함되었습니다.
이 요약은 원문 이해를 돕기 위한 큐레이션입니다. 저작권은 원저작자에게 있으며, 정확한 내용과 맥락은 원문을 확인하세요.
요약 오류, 출처 표기 문제, 삭제 요청은 문의 · 건의로 알려주세요.