AI Briefing
피드
안내
검색
EN
로그인
전체
피드·트렌딩·게시판 통합
피드
최신 뉴스
트렌딩
오픈소스·릴리즈
게시판
블로그·홍보
태그
주제별 탐색
#ai-alignment
#ai-alignment와 관련된 AI·개발 뉴스를 최신순으로 모았습니다. 원문 출처와 한국어 요약을 함께 확인할 수 있습니다.
피드
트렌딩
태그
설정
#ai-alignment 2페이지 | AI Briefing
모두에게 이익이 되도록: 우리의 계획
OpenAI Blog
·
2026.06.08 10시
Anthropic, RSI 및 AI 안전 연구
Reddit
·
2026.06.07 05시
Anthropic, AI 개발 일시 중단 제안
Reddit
·
2026.06.05 05시
Claude Opus 4.8 시스템 카드 분석
TLDR AI
·
2026.06.01 09시
AI 안전성 벤치마크 DystopiaBench 공개
Reddit
·
2026.05.18 22시
Anthropic, AI 추론 과정의 신뢰성 연구 발표
Reddit
·
2026.05.13 01시
Meta AI 에이전트의 통제 불능 사례와 안전성 문제
Reddit
·
2026.05.11 03시
Anthropic, Claude 협박 행위 원인 발표
Reddit
·
2026.05.10 01시
Anthropic, Claude 내부 사고 과정 해석 기술 공개
Reddit
·
2026.05.09 19시
자동화된 정렬 연구원: LLM을 활용한 확장 가능한 감독(Scalable Oversight)의 확장
Anthropic Research
·
2026.04.14 00시
OpenAI Safety Fellowship 발표
OpenAI Blog
·
2026.04.06 19시
AI Alignment 연구원들이 스스로를 자동화하려는 이유
TLDR AI
·
2026.04.02 09시
Model Spec에 대한 접근 방식
OpenAI Blog
·
2026.03.25 19시
AI 정렬에 관한 독립적 연구 촉진
OpenAI Blog
·
2026.02.19 19시
AI 모델의 scheming 탐지 및 완화
OpenAI Blog
·
2025.09.17 09시
집단적 정렬: Model Spec에 대한 대중의 피드백
OpenAI Blog
·
2025.08.27 22시
Anthropic, 시리즈 C 투자 유치
Anthropic News
·
2025.05.02 09시
프론티어 추론 모델의 오작동 탐지
OpenAI Blog
·
2025.03.10 19시
최신 Model Spec 공개
OpenAI Blog
·
2025.02.12 22시
Prover-Verifier 게임을 통한 언어 모델 출력 가독성 개선
OpenAI Blog
·
2024.07.17 19시
GPT-4를 활용한 GPT-4의 오류 탐지
OpenAI Blog
·
2024.06.27 19시
Model Spec 소개
OpenAI Blog
·
2024.05.08 09시
AI 그랜트 프로그램에 대한 민주적 의견 수렴: 교훈과 실행 계획
OpenAI Blog
·
2024.01.16 17시
이전
1
2
다음
이전
1
2
다음