AI Briefing
피드
안내
개발
검색
로그인
전체
피드·트렌딩·게시판 통합
피드
최신 뉴스
주간
주간·월간 인기
트렌딩
오픈소스·릴리즈
게시판
블로그·홍보
태그
주제별 탐색
#llm-optimization
피드
트렌딩
주간
태그
설정
Deep Agents v0.7 출시
LangChain Blog
·
2026.07.30 02시
Show HN: Ctrlb-decompose: LLM으로 보내기 전 로그의 노이즈를 제거하는 도구
Hacker News
·
2026.07.28 22시
에이전트에서의 Prompt Caching
TLDR AI
·
2026.07.27 09시
주간 AI/ML 주요 논문 트렌드 요약
PyTorchKR 읽을거리
·
2026.07.27 06시
에이전트 성능 저하 없는 컨텍스트 압축 도구 Distil 공개
Reddit
·
1
·
2026.07.26 08시
AI Gateway에서 서비스 티어(Service Tiers) 기능 지원 시작
Vercel Blog
·
2026.07.21 09시
LoRA Speedrun – 파인튜닝 기술을 위한 공개 워크클락 리더보드
Hacker News
·
2026.07.20 13시
추천
Bonsai 27B 1-bit 양자화, 3.9GB로 iPhone 실행
Reddit
·
2026.07.17 22시
추천
LLM 라우팅: 분류가 아닌 최적화의 문제
HuggingFace Blog
·
2026.07.16 02시
프롬프트 정밀 최적화 도구 공개
Reddit
·
2026.07.10 00시
ggml, Ternary Bonsai 지원 위한 Q2_0 양자화 추가
Reddit
·
2026.07.08 23시
MiniMax M3: Sparse Attention이 Long-Horizon Agent를 실용적으로 만드는 방법
TLDR AI
·
2026.07.08 09시
코드를 이미지로 변환하고 모델이 OCR하도록 하여 Fable 비용 60% 절감
Hacker News
·
2026.07.04 00시
Devin Fusion (8분 분량)
TLDR AI
·
2026.06.30 09시
tunelab: 소형 모델로 LLM 비용 절감
Reddit
·
2026.06.25 02시
코딩 생성(Codegen) 속도 최적화를 위한 모델 최적화 전략
TLDR AI
·
2026.06.22 09시
[2026/06/08 ~ 14] 이번 주에 살펴볼 만한 AI/ML 논문 모음
GeekNews
·
2026.06.16 11시
백만 토큰 컨텍스트를 위한 MiniMax Sparse Attention (GitHub Repo)
TLDR AI
·
2026.06.15 09시
LLM 비용 80% 절감하는 최적화 전략
Reddit
·
1
·
2026.06.05 16시
Speculative KV coding: KV cache를 최대 ~4배까지 무손실 압축하기
Hacker News
·
2026.06.05 00시
Wall Attention (GitHub 저장소)
TLDR AI
·
2026.06.03 09시
AI 에이전트 오케스트레이터 Puppetmaster 공개
Reddit
·
2026.05.31 02시
Firecrawl, AI 에이전트용 웹 모니터링 도구 출시
Product Hunt
·
2026.05.29 21시
Claude Code 프롬프트 개선 도구
Reddit
·
1
·
2026.05.29 21시
이전
1
2
다음
이전
1
2
다음