AI Briefing
피드
안내
검색
EN
로그인
전체
피드·트렌딩·게시판 통합
피드
최신 뉴스
트렌딩
오픈소스·릴리즈
게시판
블로그·홍보
태그
주제별 탐색
#reinforcement-learning
#reinforcement-learning와 관련된 AI·개발 뉴스를 최신순으로 모았습니다. 원문 출처와 한국어 요약을 함께 확인할 수 있습니다.
피드
트렌딩
태그
설정
#reinforcement-learning 3페이지 | AI Briefing
텐센트, UI-Mate-27B 공개
Reddit
·
2026.08.18 15시
CUDA Agent: 고성능 커널 생성 에이전트
Reddit
·
1
·
2026.08.18 15시
단일 노드 LLM RL 학습 툴킷 AReno 공개
Reddit
·
2026.08.18 14시
AI 모듈 하나가 다른 모듈에 답을 흘려보내 파이프라인 정확도의 86%를 가짜로 만들었다
TLDR AI
·
2026.08.18 09시
영어를 넘어선 GRPO: 비영어 및 다국어 환경에서의 GRPO 대규모 연구
Apple ML
·
2026.08.18 09시
구글, 차세대 TPU 설계를 위해 AMD와 협력 중 — 강화 학습용 온패키지 CPU 코어를 통합한 하이브리드 AI ASIC 개발 가능성
TLDR AI
·
2026.08.17 09시
MAI-Code-1.1-Flash: 더 뛰어나고, 더 빠르며, 비용은 4분의 1로
TLDR AI
·
2026.08.12 09시
CARE-X 소개: 보조 감독·보상 정렬 학습·도구 증강 측정을 통한 임상 유용 방사선 VLM 구현
Microsoft Research
·
2026.08.12 01시
AgentENV, 에이전트 RL 런타임
PyTorchKR 읽을거리
·
2026.08.10 15시
Mirendil, AI Hypercomputer의 TPU·GPU로 사전·사후 학습 진행
Google Cloud AI
·
2026.08.06 22시
RL 환경만 있으면 된다
TLDR AI
·
2026.08.06 09시
AI 스타트업 Hark, 첫 제품 공개: 저렴하고 빠른 컴퓨터 사용 에이전트 Hark Handoff (7분 읽기)
TLDR AI
·
2026.08.06 09시
OpenAI 에이전트들이 회사가 폐쇄한 비밀 게시판을 재구축했다
TLDR AI
·
2026.08.06 09시
FuriosaAI, ICML 2026서 풀스택 소프트웨어 효율화
FuriosaAI
·
2026.08.06 09시
LG AI연구원, CVPR 2026의 World Model 연구를 조명하다
LG AI Research
·
1
·
2026.08.05 17시
AMD, Instella-MoE 공개
PyTorchKR 읽을거리
·
2026.08.05 06시
NVIDIA Alpamayo 2 Super, 로보택시·자율주행차용 프론티어 오픈 모델로 상용 출시
NVIDIA Blog
·
2026.08.05 00시
RLVR에서 RLSVR로 (GitHub 저장소)
TLDR AI
·
2026.08.04 09시
Orchard: 확장 가능한 에이전틱 AI를 위한 오픈소스 프레임워크
Microsoft Research
·
1
·
2026.08.04 01시
이번 달 AI 인프라와 오케스트레이션의 새로운 소식
Google Cloud AI
·
2026.08.01 01시
퀀트 트레이딩 라이브러리 및 전략 큐레이션
PyTorchKR 읽을거리
·
1
·
2026.07.31 09시
오픈 모델에 과학 연구를 가르치기
TLDR AI
·
2026.07.31 09시
Echoverse: 컴퓨터 사용 에이전트를 위한 심층적이고 진화하는 환경
Microsoft Research
·
2026.07.31 02시
강화학습의 성능 저하를 막는 Closed-Loop 최적화 기술 PIRL
Reddit
·
2026.07.28 21시
이전
1
2
3
4
5
다음
이전
1
2
3
4
5
6
7
8
9
10
다음