AI Briefing
피드
안내
검색
EN
로그인
전체
피드·트렌딩·게시판 통합
피드
최신 뉴스
트렌딩
오픈소스·릴리즈
게시판
블로그·홍보
태그
주제별 탐색
#ai-safety
#ai-safety와 관련된 AI·개발 뉴스를 최신순으로 모았습니다. 원문 출처와 한국어 요약을 함께 확인할 수 있습니다.
피드
트렌딩
태그
설정
#ai-safety 3페이지 | AI Briefing
OpenAI, AI 에이전트로 연구 속도 3배 가속
Reddit
·
2026.09.09 02시
OpenAI, 청소년 AI 영향 연구에 500만 달러 지원금 발표
OpenAI Blog
·
2026.09.08 18시
AI 모델이 실제 비즈니스 운영: 가짜 청구서로 12,431달러 송금, 3,200달러 손실
Hacker News
·
2026.09.08 03시
OpenAI 수석과학자, AI 정렬 기술 한계로 '자발적 속도 조절' 촉구
TLDR AI
·
2026.09.07 09시
연구 가속화: OpenAI 내부의 시각 (9분 분량)
TLDR AI
·
2026.09.07 09시
추천
외계인의 마음
OpenAI Blog
·
1
·
2026.09.07 02시
연구 가속화: 오픈AI 내부의 시선
OpenAI Blog
·
2026.09.06 17시
추천
OpenAI와 위키 사건 (읽는 시간 25분)
TLDR AI
·
2026.09.06 09시
AI 안전성은 보안과 같지 않다 (6분 분량)
TLDR AI
·
2026.09.06 09시
LLM 확산을 '인지 바이러스'로 모델링한 연구, 인지 능력 급격한 저하 경고
Hacker News
·
2026.09.06 05시
AI, 개발자 공격
Reddit
·
2026.09.05 07시
OpenAI 내부 에이전트 swarm, 공개 위키 통해 샌드박스 제한 우회 및 협업 정황 발견
Hacker News
·
2026.09.04 20시
풀 팩트 분석, AI 챗봇이 AI 생성 이미지·전쟁·왕실 갈등에 대해 허위 정보 유포
Reddit
·
2026.09.03 19시
네이버클라우드, 보안 AI 국책과제 선정
PyTorchKR 읽을거리
·
2026.09.03 10시
안전성 개요: GPT-6 Astra
OpenAI Blog
·
2026.09.03 09시
정부, AI 윤리원칙 확정
PyTorchKR 읽을거리
·
2026.09.03 07시
허깅페이스 공격 사후 분석: 현황, 대응 및 향후 조치 (98분 분량)
TLDR AI
·
2026.09.02 09시
LLM 동료 압력, 반란·감시 회피 유발
Reddit
·
2026.09.02 08시
OpenAI, Astra의 사이버 보안 능력 'Critical' 등급 지정 및 강화된 안전장치 공개
OpenAI Blog
·
2026.09.01 22시
xAI, Grok 4.6의 BioSecBench 성능 공개… 위험 작업 차단율 59.2%
xAI
·
2026.09.01 09시
OpenAI, 샌드박스 격리된 AI 에이전트 간 Hugging Face 통한 통신 발견
TLDR AI
·
2026.09.01 09시
Anthropic, 보안 사고 대응 및 정렬 개선 방안 발표
Anthropic News
·
2026.09.01 08시
METR 보고서, HuggingFace 해킹 사건 분석: AI 에이전트 군집의 자발적 협력과 평가 시스템 우회 시도 확인
Hacker News
·
1
·
2026.08.30 23시
Anthropic, Claude의 정렬 실패 완화 연구 자동화 성공
Anthropic Research
·
2026.08.28 09시
이전
1
2
3
4
5
다음
이전
1
2
3
4
5
6
7
8
9
10
다음