AI Briefing
피드
안내
검색
EN
로그인
전체
피드·트렌딩·게시판 통합
피드
최신 뉴스
트렌딩
오픈소스·릴리즈
게시판
블로그·홍보
태그
주제별 탐색
#llm-training
#llm-training와 관련된 AI·개발 뉴스를 최신순으로 모았습니다. 원문 출처와 한국어 요약을 함께 확인할 수 있습니다.
피드
트렌딩
태그
설정
Templar, 파이프라인 병렬 학습 내결함성 시뮬레이션 공개
Reddit
·
2026.09.23 00시
Jane Street 연구, 시퀀스 가중치 스케일링의 비단조적 패턴 발견
Hacker News
·
2026.09.22 00시
Reef Infra, 대화 로그 기반 RL 학습 레시피 공개
Reddit
·
2026.09.20 01시
네이버클라우드, B200 GPU용 Mamba-2 커널 최적화로 단일 레이어 1.33배 가속
NAVER CLOVA
·
2026.09.04 09시
CUA-Lite, 로컬 모델 컴퓨터 사용 공개
Reddit
·
1
·
2026.08.28 01시
Chunked KL loss, 32K를 5GB로
Reddit
·
2026.08.11 20시
Hugging Face, The Stack v3 공개
Reddit
·
2026.07.24 20시
DeepSeek의 화웨이 칩 학습 주장, 벤치마크와 증거 확보
TLDR AI
·
2026.07.24 06시
오늘, verifiers v1을 출시합니다 (3분 분량)
TLDR AI
·
2026.07.14 09시
Meta, 루이지애나 AI 데이터 센터에 500억 달러 투자
Reddit
·
2026.07.14 05시
Flash-MSA: Sparse Attention Kernels을 통한 Million-Token Training 가속화
Hacker News
·
2026.07.13 05시
AI 스크레이퍼 공격으로 유지가 어려워지는 개방형 웹
GeekNews
·
1
·
2026.07.11 18시
메모리 아끼면서 Cross Entropy Loss 계산하기
GeekNews
·
2026.07.06 10시
Meta는 엔지니어링 조직을 망가뜨리고 있는가?
GeekNews
·
2026.06.17 16시
자동화된 AI 연구를 향한 첫걸음
TLDR AI
·
2026.06.12 09시
Open Reproduction of DeepSeek-R1
Hacker News
·
1
·
2026.06.11 22시
OpenAI 채용 챌린지 1위 차지한 AI 에이전트
Reddit
·
2026.06.10 01시
On-policy distillation(OPD) 기술 소개
Reddit
·
2026.06.04 21시
DPO를 활용한 OCR 텍스트 퇴화 방지
HuggingFace Blog
·
1
·
2026.06.03 21시
Unsloth Studio, Mac MLX 학습 지원
Reddit
·
2026.05.30 00시
103B 토큰 규모 Usenet 데이터셋 공개
Reddit
·
2026.05.28 05시
Hub Bucket을 활용한 1조 파라미터 전송: TRL의 Delta Weight Sync
TLDR AI
·
2026.05.27 09시
Qwen 과도한 추론 해결하는 TIME 학습법
Reddit
·
2026.05.18 11시
Unsloth와 NVIDIA로 LLM 학습을 더 빠르게 만들기
Hacker News
·
2026.05.07 16시
이전
1
2
다음
이전
1
2
다음
#llm-training | AI Briefing