AI Briefing
피드
안내
검색
EN
로그인
전체
피드·트렌딩·게시판 통합
피드
최신 뉴스
트렌딩
오픈소스·릴리즈
게시판
블로그·홍보
태그
주제별 탐색
#reinforcement-learning
#reinforcement-learning와 관련된 AI·개발 뉴스를 최신순으로 모았습니다. 원문 출처와 한국어 요약을 함께 확인할 수 있습니다.
피드
트렌딩
태그
설정
#reinforcement-learning 4페이지 | AI Briefing
9B 오픈 모델의 $500 RL 파인튜닝이 카탈로그 리뷰에서 프론티어 모델을 능가했다
Hacker News
·
2026.07.28 11시
Molt: 에이전트 기반 강화학습 프레임워크 (GitHub Repo)
TLDR AI
·
2026.07.28 09시
NVIDIA, 로봇 자율 연구 프레임워크 ENPIRE 공개
PyTorchKR 읽을거리
·
2026.07.27 12시
주간 AI/ML 주요 논문 트렌드 요약
PyTorchKR 읽을거리
·
2026.07.27 06시
LLaDA2.2-flash 공개
Reddit
·
2026.07.23 21시
NVIDIA, 최초의 GPU 가속 의료 물리 시뮬레이션 프레임워크 오픈소스 공개
NVIDIA Blog
·
2026.07.22 22시
Physical AI 발전을 위한 시뮬레이션 기술 개요
HuggingFace Blog
·
2026.07.22 05시
Sakana AI, 역전파 없는 Error Diffusion 연구 발표
PyTorchKR 읽을거리
·
2026.07.21 22시
언어 모델 하네스는 조합적 일반화를 가능하게 한다
TLDR AI
·
2026.07.21 09시
Length Value Model: 토큰 단위 길이 모델링을 위한 확장 가능한 가치 사전 학습
Apple ML
·
2026.07.20 09시
책임의 분산: Weight Transport 없이 Dale의 원칙을 준수하는 학습법
TLDR AI
·
2026.07.20 09시
NVIDIA Vera Rubin, Post-Training 워크로드의 Intelligence per Dollar 극대화 - Agentic AI의 핵심 지표
NVIDIA Blog
·
2026.07.18 00시
LG AI Research 391
LG AI Research
·
2026.07.16 09시
LG AI Research: 조합 최적화 문제를 위한 확산 모델 연구
LG AI Research
·
2026.07.16 09시
LG AI 연구원, K-EXAONE 소개
LG AI Research
·
2026.07.16 09시
[IJCAI 2022] 참관 후기 및 Deep Graph Learning 연구 동향 - LG AI Research BLOG
LG AI Research
·
2026.07.16 09시
[NeurIPS 2023] RLHF, RLAIF 연구 트렌드와 주요 논문 소개
LG AI Research
·
2026.07.16 09시
LG AI Research 294
LG AI Research
·
2026.07.16 09시
LG AI Research 271
LG AI Research
·
2026.07.16 09시
[AAAI 2026] RL-Studio: 다단계 강화학습 실험을 위한 시스템
LG AI Research
·
2026.07.16 09시
LG AI Research 235
LG AI Research
·
2026.07.16 09시
LG AI Research 253: 신경 조합 최적화 연구 동향
LG AI Research
·
2026.07.16 09시
강화학습을 시퀀스 모델링 문제로 해결하는 Decision Transformer
LG AI Research
·
2026.07.16 09시
[AAMAS 2024] 실세계 적용을 위한 Multi-Agent Reinforcement Learning (Part 1) - LG AI Research 블로그
LG AI Research
·
2026.07.16 09시
이전
2
3
4
5
6
다음
이전
1
2
3
4
5
6
7
8
9
10
다음