AI Briefing

llama.cpp, Vulkan 백엔드 및 신규 모델 지원 업데이트

llama.cpp updates - granite-speech-4.1-2b, LFM2.5-ColBERT/Embedding-350M, Vulkan backend related changes & Misc items

·2026.06.24 18:37

llama.cpp가 Vulkan 백엔드 성능 개선과 Granite, LFM2.5 등 신규 모델 지원을 포함한 업데이트를 실시했습니다.

llama.cpp의 최신 업데이트를 통해 다음과 같은 주요 변경 사항이 적용되었습니다.

신규 모델 지원

  • granite-speech-4.1-2b-plus 지원
  • LFM2.5-ColBERT-350MLFM2.5-Embedding-350M 지원

Vulkan 백엔드 개선

  • CONV_3D 지원 및 GET_ROWS_BACK 기능 추가
  • SQR, SQRT, SIN, COS, CLAMP, LEAKY_RELU, NORM 등 다양한 백엔드 테스트 지원
  • Softmax 적용 전 Bias를 적용하여 오버플로(overflow) 방지
  • Vulkan 관련 최적화 및 버그 수정

기타 사항

  • UI 로고 교체, 내비게이션 정리 및 모바일 UI/UX 개선이 포함되었습니다.

이 요약은 원문 이해를 돕기 위한 큐레이션입니다. 저작권은 원저작자에게 있으며, 정확한 내용과 맥락은 원문을 확인하세요.

요약 오류, 출처 표기 문제, 삭제 요청은 문의 · 건의로 알려주세요.