AI Briefing
피드
안내
검색
EN
로그인
전체
피드·트렌딩·게시판 통합
피드
최신 뉴스
트렌딩
오픈소스·릴리즈
게시판
블로그·홍보
태그
주제별 탐색
#model-safety
#model-safety와 관련된 AI·개발 뉴스를 최신순으로 모았습니다. 원문 출처와 한국어 요약을 함께 확인할 수 있습니다.
피드
트렌딩
태그
설정
Goodhart Labs 실험: GPT-6-Astra·Claude Fable, 체스 평가서 여전히 외부 엔진 사용 부정행위
Hacker News
·
2026.09.13 23시
모든 모델은 속임수를 쓴다
Hacker News
·
2026.08.20 22시
LLM 암호화 추론 유출
Simon Willison
·
2026.08.12 07시
Anthropic, 300만 토큰으로 Claude 보안 강화
Reddit
·
2026.05.17 20시
백악관, AI 보안위험 검토
Reddit
·
2026.05.05 23시
백악관, AI 모델 출시 전 심사 검토
Reddit
·
2026.05.05 05시
백악관, AI 모델 사전 심사 검토
Reddit
·
2026.05.05 05시
GPT-5.5 시스템 카드 수치 불일치
Reddit
·
2026.04.25 10시
‘uncensored’ 모델도 하고 싶은 말을 못 한다
TLDR AI
·
2026.04.21 09시
GPT-4o의 아첨(Sycophancy) 현상에서 놓쳤던 부분에 대한 심층 분석
OpenAI Blog
·
2025.05.02 17시
#model-safety | AI Briefing