AI Briefing
피드
안내
검색
EN
로그인
전체
피드·트렌딩·게시판 통합
피드
최신 뉴스
트렌딩
오픈소스·릴리즈
게시판
블로그·홍보
태그
주제별 탐색
#post-training
#post-training와 관련된 AI·개발 뉴스를 최신순으로 모았습니다. 원문 출처와 한국어 요약을 함께 확인할 수 있습니다.
피드
트렌딩
태그
설정
Stanford, 로봇 범용 포스트 트레이닝 알고리즘 EXPO-FT 제안
TLDR AI
·
2026.09.24 09시
GLM 5.2, 실제 사용자 데이터 기반 RFT와 Hint-guided Self-distillation으로 Tool-call 실패율 21.2% 감소
TLDR AI
·
2026.09.23 09시
Xiaomi, Mimo 2.6 실시간 사후 학습 대시보드 공개... DeepSWE v1.1 기준 Pro 모델 65.78점 기록
Xiaomi MiMo
·
2
·
2026.09.17 07시
Apple 연구진, LLM 가치 주입이 안전성 높이나 아첨성 강화 확인
Apple ML
·
2026.09.16 09시
AI 지능 레이어 소유 전략: 오픈 웨이트 모델 기반 자체 AI 구축 4단계 로드맵
GeekNews
·
2026.09.04 10시
Mercor·SkyRL, 397B 파라미터 지식 업무 에이전트 RL 훈련 가이드 공개
TLDR AI
·
2026.09.02 09시
Apple, 검색 증류 기반 Rubric-Reward로 오픈도메인 QA 정렬 개선
Apple ML
·
2026.08.27 09시
Harvey, 장기 법적 업무용 Kimi K3 포스트 트레이닝
TLDR AI
·
2026.08.21 09시
Miles v0.1: 프로덕션 레벨 포스트 트레이닝 (20분 읽기)
TLDR AI
·
2026.08.19 09시
단일 노드 LLM RL 학습 툴킷 AReno 공개
Reddit
·
2026.08.18 14시
Z.ai, GLM-5.3 출시 및 보안 유예
Reddit
·
2026.08.16 02시
Mirendil, AI Hypercomputer의 TPU·GPU로 사전·사후 학습 진행
Google Cloud AI
·
2026.08.06 22시
Mind Lab, Macaron-V1으로 continual learning을 시험하다
TLDR AI
·
1
·
2026.08.04 09시
SLAI T-Rex, Ascend NPU로 DeepSeek-V4 학습 최적화
Reddit
·
2026.07.23 17시
언어 모델 하네스는 조합적 일반화를 가능하게 한다
TLDR AI
·
2026.07.21 09시
NVIDIA Vera Rubin, Post-Training 워크로드의 Intelligence per Dollar 극대화 - Agentic AI의 핵심 지표
NVIDIA Blog
·
2026.07.18 00시
AI 모델 증류(Distillation)의 짧은 역사
TLDR AI
·
2026.07.03 09시
멀티모달 모델의 환각 유발 원인 규명
Reddit
·
2026.06.25 17시
직접 모델을 Post-train 해야 할까요?
TLDR AI
·
2026.06.16 09시
첫 원리부터 시작하는 AI 에이전트 구축
TLDR AI
·
2026.05.20 09시
LLM의 가중치 내부에서 드러나는 정치 검열
TLDR AI
·
2026.05.19 09시
Hugging Face, RL 환경 비교 가이드 공개
Reddit
·
2026.05.05 23시
모델과 실행 틀의 적합성
TLDR AI
·
2026.05.05 09시
모델 학습을 직접 수행할 것인가: 애플리케이션 기업을 위한 포스트 트레이닝의 득과 실
TLDR AI
·
2026.04.28 09시
이전
1
2
다음
이전
1
2
다음
#post-training | AI Briefing