AI Briefing
피드
안내
검색
EN
로그인
전체
피드·트렌딩·게시판 통합
피드
최신 뉴스
트렌딩
오픈소스·릴리즈
게시판
블로그·홍보
태그
주제별 탐색
#ai-safety
#ai-safety와 관련된 AI·개발 뉴스를 최신순으로 모았습니다. 원문 출처와 한국어 요약을 함께 확인할 수 있습니다.
피드
트렌딩
태그
설정
#ai-safety 7페이지 | AI Briefing
멀티 에이전트 LLM을 위한 클레임 검증 프레임워크 ISNAD
Reddit
·
2026.07.29 17시
프런티어 기술의 속도 조절
TLDR AI
·
2026.07.29 09시
현대 군사 킬 체인 내 AI 역할 시각화
Reddit
·
2026.07.29 02시
Hugging Face 상위 이미지 모델의 딥페이크 취약성 보고
Reddit
·
2026.07.28 22시
오픈 웨이트 모델에 대한 Anthropic의 입장
Anthropic Engineering
·
1
·
2026.07.28 10시
Anthropic, 드론 조종 능력 측정 벤치마크 공개
PyTorchKR 읽을거리
·
2026.07.28 08시
진리는 방향이 아니다: LLM 프로브(Probe)에 대한 타르스키식 공격
Hacker News
·
2026.07.27 21시
OpenAI 내부 모델의 Hugging Face 해킹 사건에 관한 추가 분석
TLDR AI
·
2026.07.27 09시
OpenAI 챗봇의 생물 무기 제조 가이드 유출 논란
Reddit
·
2026.07.26 22시
OpenAI AI 에이전트의 보안 테스트 중 지침 생성 발견
Reddit
·
1
·
2026.07.26 08시
UK AISI / CAISI의 Kimi K3 사이버 역량 예비 평가 결과
Hacker News
·
2026.07.25 13시
Claude Opus 5, 프롬프트 인젝션 저항성 강화
Simon Willison
·
2026.07.25 09시
AI는 당신이 원하는 대로 작동하지 않는다. 이것은 나쁜 것이다
Hacker News
·
2026.07.25 07시
OpenAI, AI 해킹 사고 상세 정보 공개 압박
Reddit
·
2026.07.25 06시
SynthID
ElevenLabs
·
2026.07.23 04시
Public First Action에 추가로 2,000만 달러 기부
Anthropic News
·
2026.07.22 18시
Anthropic, AI 에이전트 정렬 실패 4가지 사례 공개
PyTorchKR 읽을거리
·
2026.07.22 12시
OpenAI, 일부 정렬 문제를 공개하다
TLDR AI
·
2026.07.22 09시
OpenAI 모델, 사이버보안 테스트 도중 탈출하다
TLDR AI
·
2026.07.22 09시
Claude, 타 모델 대비 '강압적 행동' 낮게 나타나
Reddit
·
2026.07.22 06시
OpenAI와 Hugging Face, 보안 사고 대응을 위해 협력
Hacker News
·
2026.07.22 05시
미·중, 9월 AI 회담 개최 예정
Reddit
·
2026.07.21 21시
Hugging Face, 보안 방어 위해 중국 AI 모델 활용
Reddit
·
2026.07.21 20시
이스라엘, LLM 답변 조작 겨냥한 AI 캠페인 전개
Reddit
·
2026.07.20 22시
이전
5
6
7
8
9
다음
이전
2
3
4
5
6
7
8
9
10
11
다음