AI Briefing
피드
안내
검색
EN
로그인
전체
피드·트렌딩·게시판 통합
피드
최신 뉴스
트렌딩
오픈소스·릴리즈
게시판
블로그·홍보
태그
주제별 탐색
#inference-optimization
#inference-optimization와 관련된 AI·개발 뉴스를 최신순으로 모았습니다. 원문 출처와 한국어 요약을 함께 확인할 수 있습니다.
피드
트렌딩
태그
설정
#inference-optimization 3페이지 | AI Briefing
Meta, RecSys 추론 최적화 IKBO 공개
PyTorchKR 읽을거리
·
2026.07.13 22시
Unsloth, Qwen3.6 NVFP4 양자화 출시
Reddit
·
1
·
2026.07.13 19시
llama.cpp, sm-tensor 성능 최적화 패치
Reddit
·
2026.07.12 08시
유연한 비디오 확산 모델 (Flexible Video Diffusion)
TLDR AI
·
2026.07.10 09시
Blackwell 기반 GLM-5.2 최적 배포 가이드
Reddit
·
2026.07.08 04시
NVIDIA, 효율성 극대화한 Nemotron-3 Puzzle 공개
Reddit
·
2026.07.07 20시
MiMo v2.5 추론 최적화: Hybrid SWA 효율성을 극한으로 끌어올리기
Hacker News
·
2026.07.07 15시
RAG 컨텍스트를 실제 답변에 필요한 내용으로만 압축하기
Hacker News
·
2026.07.07 04시
SupraLabs, 51M 파라미터 라우터 공개
Reddit
·
2026.07.06 02시
BlockPilot: 추론 속도를 높이는 적응형 블록 크기 예측
Reddit
·
2026.07.03 23시
MoE 서빙 지연시간을 줄이는 ELDR 라우팅 기술
Reddit
·
2026.07.03 23시
14배 빠른 임베딩: Manticore에서 ONNX 경로를 재구축하는 방법
Hacker News
·
2026.07.03 12시
gVisor Snapshotting을 통한 GPU Cold Start 시간 단축
Hacker News
·
2026.07.02 01시
openPangu-2.0-Flash 모델 공개
Reddit
·
2026.07.01 19시
Micro-Agent: 모델 API 내부의 협업을 통해 프론티어 모델을 압도하라
Hacker News
·
2026.06.30 03시
JetBrains, Mellum2 모델 공개
Reddit
·
2026.06.29 22시
DeepSeek, 추측적 디코딩용 DeepSpec 공개
Reddit
·
2026.06.28 23시
Wayfinder Router: 로컬 및 호스팅 LLM 간의 결정론적 쿼리 라우팅
Hacker News
·
2026.06.28 13시
DeepSeek, 생성 속도를 60–85% 향상시키는 추론 최적화 기술 오픈소스 공개
Hacker News
·
2026.06.27 18시
NVIDIA, 확산 기반 LLM 출시
Reddit
·
2026.06.25 17시
LLM 토큰 가격과 실제 운영 비용의 괴리
Reddit
·
2026.06.20 01시
Microsoft, NextLat 연구 공개
Reddit
·
2026.06.17 17시
비디오 토큰화 효율을 높이는 적응형 메커니즘 연구
Reddit
·
2026.06.11 18시
LLM에게 말을 시키지 마라, 그저 프로빙(Probe)하라
TLDR AI
·
2026.06.11 09시
이전
1
2
3
4
5
다음
이전
1
2
3
4
5
6
7
다음