AI Briefing
피드
안내
개발
검색
로그인
전체
피드·트렌딩·게시판 통합
피드
최신 뉴스
주간
주간·월간 인기
트렌딩
오픈소스·릴리즈
게시판
블로그·홍보
태그
주제별 탐색
#reinforcement-learning
피드
트렌딩
주간
태그
설정
AMD, Instella-MoE 공개
PyTorchKR 읽을거리
·
2026.08.05 06시
NVIDIA Alpamayo 2 Super, 로보택시·자율주행차용 프론티어 오픈 모델로 상용 출시
NVIDIA Blog
·
2026.08.05 00시
RLVR에서 RLSVR로 (GitHub 저장소)
TLDR AI
·
2026.08.04 09시
Orchard: 확장 가능한 에이전틱 AI를 위한 오픈소스 프레임워크
Microsoft Research
·
2026.08.04 01시
이번 달 AI 인프라와 오케스트레이션의 새로운 소식
Google Cloud AI
·
2026.08.01 01시
퀀트 트레이딩 라이브러리 및 전략 큐레이션
PyTorchKR 읽을거리
·
1
·
2026.07.31 09시
오픈 모델에 과학 연구를 가르치기
TLDR AI
·
2026.07.31 09시
Echoverse: 컴퓨터 사용 에이전트를 위한 심층적이고 진화하는 환경
Microsoft Research
·
2026.07.31 02시
강화학습의 성능 저하를 막는 Closed-Loop 최적화 기술 PIRL
Reddit
·
2026.07.28 21시
9B 오픈 모델의 $500 RL 파인튜닝이 카탈로그 리뷰에서 프론티어 모델을 능가했다
Hacker News
·
2026.07.28 11시
Molt: 에이전트 기반 강화학습 프레임워크 (GitHub Repo)
TLDR AI
·
2026.07.28 09시
NVIDIA, 로봇 자율 연구 프레임워크 ENPIRE 공개
PyTorchKR 읽을거리
·
2026.07.27 12시
주간 AI/ML 주요 논문 트렌드 요약
PyTorchKR 읽을거리
·
2026.07.27 06시
LLaDA2.2-flash 공개
Reddit
·
2026.07.23 21시
NVIDIA, 최초의 GPU 가속 의료 물리 시뮬레이션 프레임워크 오픈소스 공개
NVIDIA Blog
·
2026.07.22 22시
Physical AI 발전을 위한 시뮬레이션 기술 개요
HuggingFace Blog
·
2026.07.22 05시
Sakana AI, 역전파 없는 Error Diffusion 연구 발표
PyTorchKR 읽을거리
·
2026.07.21 22시
언어 모델 하네스는 조합적 일반화를 가능하게 한다
TLDR AI
·
2026.07.21 09시
Length Value Model: 토큰 단위 길이 모델링을 위한 확장 가능한 가치 사전 학습
Apple ML
·
2026.07.20 09시
책임의 분산: Weight Transport 없이 Dale의 원칙을 준수하는 학습법
TLDR AI
·
2026.07.20 09시
NVIDIA Vera Rubin, Post-Training 워크로드의 Intelligence per Dollar 극대화 - Agentic AI의 핵심 지표
NVIDIA Blog
·
2026.07.18 00시
LG AI Research 631
LG AI Research
·
2026.07.16 09시
LG AI 연구원: 상태 정보만으로 학습하는 오프라인 모방학습 방법론 제시
LG AI Research
·
2026.07.16 09시
LG AI Research 125
LG AI Research
·
2026.07.16 09시
이전
1
2
더 많은 페이지
7
다음
이전
1
2
3
4
5
6
7
다음