AI Briefing
피드
안내
검색
EN
로그인
전체
피드·트렌딩·게시판 통합
피드
최신 뉴스
트렌딩
오픈소스·릴리즈
게시판
블로그·홍보
태그
주제별 탐색
#inference-optimization
#inference-optimization와 관련된 AI·개발 뉴스를 최신순으로 모았습니다. 원문 출처와 한국어 요약을 함께 확인할 수 있습니다.
피드
트렌딩
태그
설정
Liquid AI, LFM2.5-VL 추론 가속하는 LFM2.5-VL-DSpark 공개
HuggingFace Blog
·
2026.09.24 23시
Stanford·NVIDIA, 추론 속도 9배 개선한 '대조 언어 모델' CLM 공개
Hacker News
·
2026.09.24 13시
Meta, 실시간 동기화 아바타 생성 기술 'Muse Realtime Avatar' 공개
TLDR AI
·
2026.09.23 09시
LLM 간 텍스트 없이 KV-cache 직접 통신하는 'Cache-to-Cache' 프레임워크 공개
Hacker News
·
2026.09.19 03시
Video Rebirth, MiniMax-H3용 8단계 LoRA 'HyperFlow' 공개
Reddit
·
2026.09.19 02시
GLM-5.3-Flash, 10만 개 이상 중국산 가속기 클러스터 추론 인프라 자체 구축… 성능 약 3배 향상
TLDR AI
·
2026.09.18 09시
Pinterest, 3-Tower Engagement Co-Train 모델 공개… CTR 1% 상승 및 레이턴시 30ms 달성
Pinterest Engineering
·
2026.09.18 00시
Apple 연구, 에너지 나침반으로 이산 흐름 매칭 궤적 개선… 8단계 추론으로 교사 모델 대비 퍼플렉시티 32% 감소
Apple ML
·
2026.09.16 09시
OpenWAM, 로봇 WAM 설계 비교용 오픈소스 스택 공개
PyTorchKR 읽을거리
·
1
·
2026.09.14 09시
추천
DeepSeek, V4.1-Flash 공개… V4-Pro 대체 및 KV 캐시 최적화
PyTorchKR 읽을거리
·
3
·
2026.09.11 14시
NVIDIA Dynamo 기반의 Pinterest VLM 서빙 스택 구축
Pinterest Engineering
·
3
·
2026.09.11 08시
NVIDIA Dynamo, 비전 인코더 분리 서빙 기술 공개
PyTorchKR 읽을거리
·
2026.09.11 07시
VDN-H3: 재생 시간보다 빠르게 영상을 생성하는 하이브리드 어텐션 모델 MiniMax H3 (단, H3 모델은 한국 사용 불가 주의)
PyTorchKR 읽을거리
·
2026.09.09 18시
vLLM, AMD GPU 환경에서 5가지 Speculative Decoding 방식 성능 벤치마크 공개
Hacker News
·
2026.09.07 18시
LLM, 스스로 주의 범위 선언
Reddit
·
2026.09.05 15시
GLM-OCR 기반 Diffusion 초안 생성 및 AR 검증 기법으로 추론 속도 3.85배 가속
GeekNews
·
1
·
2026.09.03 18시
Apple Silicon 전용 추론 엔진 'Lily', MLX-LM 대비 디코딩 속도 35% 향상
TLDR AI
·
2026.09.02 09시
llama.cpp, Qwen3.8 Metal 최적화
Reddit
·
2026.08.28 07시
Qwen4Exp, N-gram 아키텍처 분석
Reddit
·
4
·
2026.08.27 11시
4비트 LLM, 원본 모델 성능 역전
HuggingFace Blog
·
1
·
2026.08.25 20시
주간 AI 논문: 에이전트 RL 및 추론 최적화
PyTorchKR 읽을거리
·
2026.08.24 06시
Unsloth Dynamic 3.0 GGUFs
Hacker News
·
2026.08.20 03시
vLLM 병목 진단 도구 'Profile' 출시
Reddit
·
1
·
2026.08.19 05시
저비트(1-bit/Ternary) 모델 및 추론 최적화 업데이트 현황
Reddit
·
2026.08.19 03시
이전
1
2
3
4
5
다음
이전
1
2
3
4
5
6
7
다음
#inference-optimization | AI Briefing