AI Briefing
피드
안내
개발
검색
로그인
전체
피드·트렌딩·게시판 통합
피드
최신 뉴스
주간
주간·월간 인기
트렌딩
오픈소스·릴리즈
게시판
블로그·홍보
태그
주제별 탐색
#mechanistic-interpretability
피드
트렌딩
주간
태그
설정
Anthropic, Jacobian Lens 오픈소스 공개
PyTorchKR 읽을거리
·
2026.07.22 20시
AI 에이전트 도구 사용의 해석 가능성 연구
Reddit
·
2026.07.19 22시
Coding agents think ahead of time
Hacker News
·
2026.07.14 21시
Anthropic, 모델 내부의 개념 형성 과정 포착
Reddit
·
2026.07.13 21시
LLM의 거절 행동을 유도하는 문맥 효과 발견
Reddit
·
2026.06.23 20시
LLM 정렬(Alignment)은 마지막 레이어에 집중된다
Reddit
·
2026.06.15 01시
숫자 없는 산술 – LLM이 수학을 수행하는 방식
Hacker News
·
2026.06.05 19시
LLM은 당신이 약속받았던 블랙박스가 아니다
Hacker News
·
2026.06.03 08시
LLM의 주관적 경험 보고 메커니즘 규명
Reddit
·
2026.05.29 00시
그래프 분석으로 grokking 조기 예측
Reddit
·
2026.05.19 23시
LLM의 가중치 내부에서 드러나는 정치 검열
TLDR AI
·
2026.05.19 09시
Natural Language Autoencoders: Claude의 생각을 텍스트로 바꾸기
GeekNews
·
2026.05.09 04시
Claude의 생각을 텍스트로 바꾸는 자연어 오토인코더
TLDR AI
·
2026.05.08 09시
Qwen3.5-27B용 SAE 해석모듈 공개
Reddit
·
2026.05.03 06시
Qwen-Scope 공식 SAE 공개
Reddit
·
2026.04.30 18시
sparse circuits를 통한 신경망 이해
OpenAI Blog
·
2025.11.13 19시