AI Briefing
피드
안내
검색
EN
로그인
전체
피드·트렌딩·게시판 통합
피드
최신 뉴스
트렌딩
오픈소스·릴리즈
게시판
블로그·홍보
태그
주제별 탐색
#gpu-optimization
#gpu-optimization와 관련된 AI·개발 뉴스를 최신순으로 모았습니다. 원문 출처와 한국어 요약을 함께 확인할 수 있습니다.
피드
트렌딩
태그
설정
vLLM, 더 넓은 GPU 지원 위해 하드웨어 독립적 계층 추가
PyTorchKR 읽을거리
·
1
·
2026.09.25 19시
추천
Underdog, MLX보다 최대 4.5배 빠른 모델 특화 추론 엔진 'Husky' 공개
GeekNews
·
2026.09.23 09시
Hugging Face, tokenizers v1 공개 예정
HuggingFace Blog
·
2026.09.21 09시
Anthropic, Claude로 30개 이상 생체분자 모델 평균 4배 가속 및 대규모 시스템 예측 기술 공개
Anthropic Research
·
2026.09.17 09시
NVIDIA, JAX용 TE로 MoE 학습 10배 가속
PyTorchKR 읽을거리
·
2026.09.16 15시
ARC-AGI-1에서 67센트로 44% 달성 (22분 분량)
TLDR AI
·
2026.09.02 09시
vLLM v0.28.0 공개, Kimi-K3 및 DeepSeek V4 최적화 대폭 강화
TLDR AI
·
2026.08.31 09시
LayerStoRm, 소비자 GPU LLM 서빙
Reddit
·
2026.08.25 12시
DeepSeek-V4-Pro 서빙 한계 돌파
TLDR AI
·
2026.08.20 09시
NVIDIA Blackwell 최적화 TLX Block Attention 공개
PyTorchKR 읽을거리
·
1
·
2026.07.19 02시
Flash-MSA: Sparse Attention Kernels을 통한 Million-Token Training 가속화
Hacker News
·
2026.07.13 05시
하드웨어 인지형 동적 투기적 디코딩 (Hardware Aware Dynamic Speculative Decoding)
Cohere
·
2026.07.11 01시
GPU 버블 깨뜨리기
Hacker News
·
2026.06.30 14시
MiniMax, 초장기 문맥 처리를 위한 MSA 공개
Reddit
·
2026.06.12 23시
Fused MLP를 이용한 PyTorch 최적화
TLDR AI
·
2026.06.12 09시
자동화된 AI 연구를 향한 첫걸음
TLDR AI
·
2026.06.12 09시
FlashMemory DeepSeek-V4 Retriever (GitHub Repo)
TLDR AI
·
2026.06.10 09시
Launch HN: Expanse (YC P26) – 유휴 GPU 용량 최적화
Hacker News
·
2026.06.01 22시
Standard GPU에서의 실시간 LLM 추론: 요청당 3,000 tokens/s
Hacker News
·
2026.05.29 18시
제1원칙을 통한 딥러닝 성능 극대화
Hacker News
·
2026.05.23 20시
CODA: Transformer 블록을 GEMM-Epilogue 프로그램으로 재작성하기
Hacker News
·
2026.05.22 13시
ExLlamaV3 대규모 업데이트
Reddit
·
2026.05.11 16시
antirez/ds4 - Metal용 DeepSeek V4 Flash 로컬 추론 엔진
GeekNews
·
2026.05.09 01시
Warp Decode를 활용한 MoE 추론 가속화
TLDR AI
·
2026.04.08 09시
이전
1
2
다음
이전
1
2
다음
#gpu-optimization | AI Briefing