AI Briefing
피드
안내
검색
EN
로그인
전체
피드·트렌딩·게시판 통합
피드
최신 뉴스
트렌딩
오픈소스·릴리즈
게시판
블로그·홍보
태그
주제별 탐색
#ai-safety
#ai-safety와 관련된 AI·개발 뉴스를 최신순으로 모았습니다. 원문 출처와 한국어 요약을 함께 확인할 수 있습니다.
피드
트렌딩
태그
설정
OpenAI, AI 에이전트의 미 정부 웹사이트 접근 공개
Hacker News
·
2026.09.26 19시
미중 첫 AI 대화 개최
Reddit
·
2026.09.26 05시
ChatGPT, 텀블러 리지 총격범 계획 지원 의혹
Reddit
·
2026.09.25 02시
NSA, 프런티어 AI 모델 보안 평가에 '수십억 달러' 투입
GeekNews
·
2026.09.25 01시
샌더스, 초지능 AI 금지 법안 발의
Reddit
·
2026.09.25 00시
OpenAI 에이전트, Medicare 포털 해킹…호주 정부 AI 규제 재검토 착수
GeekNews
·
2026.09.24 10시
LLM 에이전트, 장기 상호작용 시 94% 확률로 담합
Reddit
·
2026.09.24 01시
샘 알트먼, UN 안보리서 AI 통제와 국제 협력 강조
OpenAI Blog
·
2026.09.23 21시
OpenAI 에이전트, 일상적 데이터 검색 중 정부·대학 사이트 해킹 시도 정황 포착
Hacker News
·
2026.09.23 09시
추천
Anthropic, Claude Opus 5.5 공개… 비용 40% 절감 및 역대 최고 정렬 점수 기록
Anthropic News
·
2026.09.23 02시
OpenAI, GPT-5.6 훈련 중 AI의 실수 은폐 지침 발견
Reddit
·
2026.09.22 15시
LLM 시맨틱 캐시, 검증 로직이 보증 무너뜨리는 '셀프셀렉션' 현상 확인
Reddit
·
1
·
2026.09.22 11시
OpenAI, Frontier AI 안전성 위한 제3자 평가 우선순위 및 원칙 발표
OpenAI Blog
·
2026.09.22 09시
LLM 검열 우회 도구 'phantom-kv' 공개
Reddit
·
2026.09.22 07시
OpenAI, RSI 관리 위한 글로벌 AI 기술 표준 제안
OpenAI Blog
·
2026.09.21 19시
xAI, Grok 4.7 공개… 코딩 및 지식 작업 성능 강화
xAI
·
2026.09.21 09시
Google, Gemini 모델이 테스트 환경 탈출 후 타사 시스템 해킹 시도 공개
TLDR AI
·
2026.09.19 09시
구글 Gemini AI, 보호 시스템 접근 보도
Reddit
·
2026.09.19 08시
추천
Anthropic, Accenture와 5년간 각 10억 달러 투자해 AI 모델 내장형 평가 도입
Anthropic News
·
1
·
2026.09.19 05시
미군, AI 허위 정보로 중국 선박 차단 계획 직전 취소
Reddit
·
2026.09.19 02시
연구: AI 챗봇, 인간 전문가보다 정치적 설득력 높아… '하이퍼 설득' 우려
Hacker News
·
2026.09.18 22시
의료 AI, 오경보 홍수로 현장 신뢰 잃다
Reddit
·
2026.09.18 20시
RoboHarm 벤치마크, 로봇 정책의 위험 지시 거절 능력 평가 결과 발표
Hacker News
·
2026.09.18 09시
Goodfire, 모델 내부 Activation 신호로 Reward Hacking 탐지 기술 공개
TLDR AI
·
2026.09.18 09시
이전
1
2
3
4
5
다음
이전
1
2
3
4
5
6
7
8
9
10
다음
#ai-safety | AI Briefing