AI Briefing
피드
안내
검색
EN
로그인
전체
피드·트렌딩·게시판 통합
피드
최신 뉴스
트렌딩
오픈소스·릴리즈
게시판
블로그·홍보
태그
주제별 탐색
#llm-alignment
#llm-alignment와 관련된 AI·개발 뉴스를 최신순으로 모았습니다. 원문 출처와 한국어 요약을 함께 확인할 수 있습니다.
피드
트렌딩
태그
설정
올리브영, NLL 지표 기반 정렬 학습으로 AI Pick 추천 카드 품질·형식 동시 개선
올리브영
·
1
·
2026.09.18 17시
LLM의 '아첨' 현상: 인간보다 49% 더 동조
Reddit
·
2026.08.18 03시
긴 컨텍스트가 LLM의 RLHF 정렬을 무력화한다
Reddit
·
2026.08.17 06시
Anthropic 협업, 지식 접근 제어 기술 GRAM 공개
PyTorchKR 읽을거리
·
2026.07.29 21시
Anthropic, Claude의 가치관 변화 연구 공개
PyTorchKR 읽을거리
·
2026.07.21 18시
모델 및 언어에 따른 Claude의 가치관 분석
Anthropic Research
·
2026.07.13 09시
LLM 정렬(Alignment)은 마지막 레이어에 집중된다
Reddit
·
2026.06.15 01시
Opus 4.8 파트 2: 모델 복지 (Model Welfare)
TLDR AI
·
2026.06.02 09시
AI 강건성 기법의 수학적 통합 원리 규명
Reddit
·
1
·
2026.05.26 13시
OpenAI와 Anthropic, 공동 안전성 평가 결과 공유
OpenAI Blog
·
2025.08.27 19시
HuggingFace, 오픈 LLM용 CAI 레시피 공개
HuggingFace Blog
·
2024.02.01 09시
DPO, IPO, KTO 선호도 정렬 방법론 비교
HuggingFace Blog
·
2024.01.18 09시
PPO 기반 RLHF 구현 가이드 및 재현 결과
HuggingFace Blog
·
2023.10.24 09시
#llm-alignment | AI Briefing