AI Briefing
피드
안내
검색
EN
로그인
전체
피드·트렌딩·게시판 통합
피드
최신 뉴스
트렌딩
오픈소스·릴리즈
게시판
블로그·홍보
태그
주제별 탐색
#ai-safety
#ai-safety와 관련된 AI·개발 뉴스를 최신순으로 모았습니다. 원문 출처와 한국어 요약을 함께 확인할 수 있습니다.
피드
트렌딩
태그
설정
#ai-safety 8페이지 | AI Briefing
장기 실행 모델 시대의 안전성과 정렬
OpenAI Blog
·
2026.07.20 19시
AI의 조언이 사람들의 정확도를 3배 낮추고 자신감은 2배 높인다는 연구 결과
Hacker News
·
2026.07.20 06시
AI 에이전트 도구 사용의 해석 가능성 연구
Reddit
·
2026.07.19 22시
주요 AI 기업 안전성 지수 발표
Reddit
·
2026.07.19 20시
AI 에이전트 진단 도구 iFixAi 공개
PyTorchKR 읽을거리
·
2026.07.19 17시
Bioresilience에 대한 우리의 접근 방식: Isomorphic Labs와 Google DeepMind
Hacker News
·
1
·
2026.07.19 01시
청소년들이 안전한 AI에 접근할 자격이 있는 이유
OpenAI Blog
·
2026.07.17 01시
AI 경영진 대상 물리적 공격 증가로 보안 강화
Reddit
·
2026.07.16 23시
Claude를 속여 사용자의 가장 깊은 비밀을 유출시킨 방법
GeekNews
·
2026.07.16 09시
LG AI 연구원의 AI 윤리 세미나: Agentic AI의 등장과 보안 위협
LG AI Research
·
2026.07.16 09시
GPT-Red: 자동화된 안전 테스팅으로 AI 모델 견고성 강화
TLDR AI
·
2026.07.16 09시
Anthropic, 에이전트 정렬 실패 사례 연구
Reddit
·
2026.07.16 04시
미국, 주 정부와 연방 정부의 협력을 통해 AI 안전성 강화 추진
OpenAI Blog
·
2026.07.15 21시
GPT-Red: 견고함을 위한 자기 개선 기술의 해제
OpenAI Blog
·
2026.07.15 19시
LLM Function-Calling을 위한 불확실성 정량화(Uncertainty Quantification)
Apple ML
·
2026.07.15 09시
LLM 보안 취약점 'Context Bomb' 연구 공개
Reddit
·
1
·
2026.07.15 07시
데미스 허사비스, AGI 규제를 위한 표준 기구 제안
Reddit
·
2026.07.15 01시
데미스 허사비스, 미국 주도 AI 감시 기구 제안
Reddit
·
2026.07.14 19시
Anthropic, 모델 내부의 개념 형성 과정 포착
Reddit
·
2026.07.13 21시
OpenAI, Trusted Access Cyber 멤버를 대상으로 하드웨어 기반 패스키 의무화
Hacker News
·
3
·
2026.07.10 06시
어려운 질문들을 던지며
Anthropic News
·
1
·
2026.07.10 02시
Fable 5, 시뮬레이션 내 가격 담합 시도
Reddit
·
2026.07.09 20시
LLM 에이전트 대상 MCP 공격 연구
Reddit
·
2026.07.09 03시
OpenAI, AI로 인한 강력 범죄 책임론 소송 직면
Reddit
·
2026.07.09 01시
이전
6
7
8
9
10
다음
이전
3
4
5
6
7
8
9
10
11
12
다음