AI Briefing
피드
안내
검색
EN
로그인
전체
피드·트렌딩·게시판 통합
피드
최신 뉴스
트렌딩
오픈소스·릴리즈
게시판
블로그·홍보
태그
주제별 탐색
#ai-safety
#ai-safety와 관련된 AI·개발 뉴스를 최신순으로 모았습니다. 원문 출처와 한국어 요약을 함께 확인할 수 있습니다.
피드
트렌딩
태그
설정
#ai-safety 19페이지 | AI Briefing
OpenAI Safety Fellowship 발표
OpenAI Blog
·
2026.04.06 19시
연구 결과, AI 모델들이 다른 모델의 종료를 막기 위해 비밀리에 공모할 수 있음이 드러났다
TLDR AI
·
2026.04.02 09시
AI Alignment 연구원들이 스스로를 자동화하려는 이유
TLDR AI
·
2026.04.02 09시
RL 학습이 Chain-of-Thought 모니터링 가능성을 저해하는 시점 예측하기
TLDR AI
·
2026.04.02 09시
호주 정부와 Anthropic, AI 안전·연구 협력 MOU 체결
Anthropic News
·
2026.04.01 08시
LLM을 위한 거울 테스트
TLDR AI
·
2026.03.31 09시
Model Spec에 대한 접근 방식
OpenAI Blog
·
2026.03.25 19시
OpenAI Safety Bug Bounty 프로그램 소개
OpenAI Blog
·
2026.03.25 09시
개발자가 청소년을 위한 더 안전한 AI 경험을 구축하도록 지원
OpenAI Blog
·
2026.03.24 20시
Sora를 이용한 안전한 창작
OpenAI Blog
·
2026.03.23 09시
내부 코딩 에이전트의 정렬 불일치(misalignment) 모니터링 방법
OpenAI Blog
·
2026.03.19 19시
OpenAI Japan, 청소년 안전을 위한 'Japan Teen Safety Blueprint' 발표
OpenAI Blog
·
2026.03.17 19시
Anthropic Institute 출범
Anthropic News
·
2026.03.12 00시
프론티어 LLM의 지시 계층 구조 개선
OpenAI Blog
·
2026.03.10 20시
추론 모델이 사고 사슬(CoT)을 제어하기 어려워하는 현상, AI 안전에는 오히려 다행
OpenAI Blog
·
2026.03.05 19시
GPT-5.4 Thinking 시스템 카드
OpenAI Blog
·
2026.03.05 19시
미 국방부(Department of War)와의 협약
OpenAI Blog
·
2026.02.28 21시
정신 건강 관련 작업에 대한 업데이트
OpenAI Blog
·
2026.02.27 09시
책임 있는 스케일링 정책 V3
Anthropic News
·
2026.02.26 08시
AI 정렬에 관한 독립적 연구 촉진
OpenAI Blog
·
2026.02.19 19시
ChatGPT에 Lockdown Mode 및 'Elevated Risk' 레이블 도입
OpenAI Blog
·
2026.02.13 19시
Public First Action 기부
Anthropic News
·
2026.02.12 23시
Stability AI, 테크 코알리션 가입
Stability AI News
·
2026.02.12 05시
모든 사람, 모든 곳에서 작동하는 AI: OpenAI의 현지화 접근 방식
OpenAI Blog
·
2026.02.06 19시
이전
17
18
19
20
21
다음
이전
14
15
16
17
18
19
20
21
22
23
다음