AI Briefing
피드
안내
개발
검색
로그인
전체
피드·트렌딩·게시판 통합
피드
최신 뉴스
주간
주간·월간 인기
트렌딩
오픈소스·릴리즈
게시판
블로그·홍보
태그
주제별 탐색
#gpu-optimization
피드
트렌딩
주간
태그
설정
Cursor, MoE 커널 공개
Reddit
·
2026.08.05 02시
NVIDIA Blackwell 최적화 TLX Block Attention 공개
PyTorchKR 읽을거리
·
1
·
2026.07.19 02시
Flash-MSA: Sparse Attention Kernels을 통한 Million-Token Training 가속화
Hacker News
·
2026.07.13 05시
하드웨어 인지형 동적 투기적 디코딩 (Hardware Aware Dynamic Speculative Decoding)
Cohere
·
2026.07.11 01시
GPU 버블 깨뜨리기
Hacker News
·
2026.06.30 14시
MiniMax, 초장기 문맥 처리를 위한 MSA 공개
Reddit
·
2026.06.12 23시
자동화된 AI 연구를 향한 첫걸음
TLDR AI
·
2026.06.12 09시
Fused MLP를 이용한 PyTorch 최적화
TLDR AI
·
2026.06.12 09시
FlashMemory DeepSeek-V4 Retriever (GitHub Repo)
TLDR AI
·
2026.06.10 09시
Launch HN: Expanse (YC P26) – 유휴 GPU 용량 최적화
Hacker News
·
2026.06.01 22시
Standard GPU에서의 실시간 LLM 추론: 요청당 3,000 tokens/s
Hacker News
·
2026.05.29 18시
제1원칙을 통한 딥러닝 성능 극대화
Hacker News
·
2026.05.23 20시
CODA: Transformer 블록을 GEMM-Epilogue 프로그램으로 재작성하기
Hacker News
·
2026.05.22 13시
ExLlamaV3 대규모 업데이트
Reddit
·
2026.05.11 16시
antirez/ds4 - Metal용 DeepSeek V4 Flash 로컬 추론 엔진
GeekNews
·
2026.05.09 01시
Warp Decode를 활용한 MoE 추론 가속화
TLDR AI
·
2026.04.08 09시
T4 GPU 1장으로 일궈낸 올리브영의 Gemma 3 기반 sLLM 구축기
올리브영
·
2026.01.21 09시
Hugging Face, CUDA 커널 빌드 도구 공개
HuggingFace Blog
·
2025.08.18 09시
Hugging Face, Kernel Hub 공개
HuggingFace Blog
·
2025.06.12 09시
Hugging Face, 초고속 Whisper 엔드포인트
HuggingFace Blog
·
2025.05.13 09시