AI Briefing

llama.cpp, Vulkan 백엔드 및 신규 모델 지원 업데이트

llama.cpp updates - granite-speech-4.1-2b, LFM2.5-ColBERT/Embedding-350M, Vulkan backend related changes & Misc items

·2026.06.24 18:37

핵심 내용

llama.cpp가 Vulkan 백엔드 성능 개선과 Granite, LFM2.5 등 신규 모델 지원을 포함한 업데이트를 실시했습니다.

자세히 보기

llama.cpp의 최신 업데이트를 통해 다음과 같은 주요 변경 사항이 적용되었습니다.

신규 모델 지원

  • granite-speech-4.1-2b-plus 지원
  • LFM2.5-ColBERT-350M 및 LFM2.5-Embedding-350M 지원

Vulkan 백엔드 개선

  • CONV_3D 지원 및 GET_ROWS_BACK 기능 추가
  • SQR, SQRT, SIN, COS, CLAMP, LEAKY_RELU, NORM 등 다양한 백엔드 테스트 지원
  • Softmax 적용 전 Bias를 적용하여 오버플로(overflow) 방지
  • Vulkan 관련 최적화 및 버그 수정

기타 사항

  • UI 로고 교체, 내비게이션 정리 및 모바일 UI/UX 개선이 포함되었습니다.

이 한국어 요약은 AI가 자동으로 만들었습니다. 원문의 주장과 맥락은 원문에서 확인해 주세요. 저작권은 원저작자에게 있습니다.

AI 처리 방식을 확인하거나, 요약 오류와 출처 표기 문제, 삭제 요청을 문의 · 건의로 알려주세요.