AI Briefing
피드
안내
검색
EN
로그인
전체
피드·트렌딩·게시판 통합
피드
최신 뉴스
트렌딩
오픈소스·릴리즈
게시판
블로그·홍보
태그
주제별 탐색
#llama.cpp
#llama.cpp와 관련된 AI·개발 뉴스를 최신순으로 모았습니다. 원문 출처와 한국어 요약을 함께 확인할 수 있습니다.
피드
트렌딩
태그
설정
#llama.cpp 2페이지 | AI Briefing
llama.cpp에 새로운 'Scatter' 샘플러 추가
Reddit
·
2026.07.04 06시
llama.cpp, DeepSeek V4 지원 시작
Reddit
·
2026.06.30 03시
llama.cpp, Vulkan 백엔드 및 신규 모델 지원 업데이트
Reddit
·
2026.06.24 18시
Cohere, 코드 특화 모델 North Mini Code 공개
Reddit
·
2026.06.14 02시
llama.cpp WebGPU 추론 성능 개선
Reddit
·
2026.06.09 11시
llama.cpp, 비디오 입력 지원 기능 추가
Reddit
·
2026.06.08 22시
llama.cpp, KV 캐시 복사 방지로 성능 개선
Reddit
·
2026.06.08 21시
Gemma 4 QAT MTP 헤드 공개 및 오류 수정
Reddit
·
1
·
2026.06.07 06시
llama.cpp, Intel Arc 성능 45% 향상
Reddit
·
2026.06.06 03시
llama.cpp 동적 KV 캐시 양자화 기능
Reddit
·
2026.06.05 03시
llama.cpp, Mermaid 다이어그램 지원
Reddit
·
2026.06.04 00시
llama.cpp, StepFun 3.5 MTP 지원
Reddit
·
2026.06.03 00시
llama.cpp, 추론 수준 조절 기능 추가
Reddit
·
1
·
2026.06.02 22시
llama.cpp, Step3.7-Flash 지원 추가
Reddit
·
2026.06.02 18시
llama.cpp 멀티 GPU KV 캐시 오류 수정
Reddit
·
2026.06.02 05시
llama.cpp, VRAM 사용량 최적화 PR 제안
Reddit
·
2026.06.02 00시
llama.cpp, MTP VRAM 절감 업데이트
Reddit
·
2026.05.30 05시
llama.cpp, Flash Attention VRAM 최적화
Reddit
·
2026.05.29 16시
llama.cpp, MiniCPM5 지원 추가
Reddit
·
2026.05.27 14시
llama.cpp, CUDA용 FWHT로 추론 속도 개선
Reddit
·
2026.05.26 02시
llama.cpp, 멀티 GPU 충돌 수정 예정
Reddit
·
1
·
2026.05.26 01시
llama.cpp, 컨텍스트 재처리 최적화
Reddit
·
1
·
2026.05.25 15시
llama.cpp 비대칭 KV 캐시 양자화 이슈 및 최적화 논의
Reddit
·
3
·
2026.05.22 22시
llama.cpp, MTP 성능 개선
Reddit
·
2026.05.21 02시
이전
1
2
3
4
다음
이전
1
2
3
4
다음