AI Briefing
피드
안내
검색
EN
로그인
전체
피드·트렌딩·게시판 통합
피드
최신 뉴스
트렌딩
오픈소스·릴리즈
게시판
블로그·홍보
태그
주제별 탐색
#alignment
#alignment와 관련된 AI·개발 뉴스를 최신순으로 모았습니다. 원문 출처와 한국어 요약을 함께 확인할 수 있습니다.
피드
트렌딩
태그
설정
#alignment 3페이지 | AI Briefing
GPT-5.5: 시스템 카드 (20분 읽기)
TLDR AI
·
2026.04.28 09시
Alignment, 단호함만 높였다
Reddit
·
2026.04.28 05시
OpenAI, AGI 5대 원칙 공개…올트먼, 더 큰 역할 인정
TLDR AI
·
2026.04.27 09시
우리의 원칙
OpenAI Blog
·
1
·
2026.04.27 01시
‘uncensored’ 모델도 하고 싶은 말을 못 한다
TLDR AI
·
2026.04.21 09시
Sonnet만 흔들린다
Reddit
·
2026.04.15 23시
사회공학형 젤브레이크
Reddit
·
2026.04.15 23시
대규모 언어 모델의 감정 개념과 그 기능
Anthropic Research
·
2026.04.02 00시
내부 코딩 에이전트의 정렬 불일치(misalignment) 모니터링 방법
OpenAI Blog
·
2026.03.19 19시
추론 모델이 사고 사슬(CoT)을 제어하기 어려워하는 현상, AI 안전에는 오히려 다행
OpenAI Blog
·
2026.03.05 19시
언어 모델의 정직성을 유지하는 방법: '고백(Confessions)' 기술
OpenAI Blog
·
2025.12.03 19시
AI의 발전과 권고 사항
OpenAI Blog
·
2025.11.06 09시
TRL, VLM 정렬 기술 지원 확대
HuggingFace Blog
·
2025.08.07 09시
Deliberative alignment: 추론을 통한 더 안전한 언어 모델 구현
OpenAI Blog
·
2024.12.20 19시
Zico Kolter, OpenAI 이사회 합류
OpenAI Blog
·
2024.08.08 21시
OpenAI의 안전성 관리 실천 방안
OpenAI Blog
·
2024.05.21 15시
RLHF의 핵심 단계와 작동 원리
HuggingFace Blog
·
2022.12.09 09시
이전
1
2
3
다음
이전
1
2
3
다음