AI Briefing
피드
안내
검색
EN
로그인
전체
피드·트렌딩·게시판 통합
피드
최신 뉴스
트렌딩
오픈소스·릴리즈
게시판
블로그·홍보
태그
주제별 탐색
#mechanistic-interpretability
#mechanistic-interpretability와 관련된 AI·개발 뉴스를 최신순으로 모았습니다. 원문 출처와 한국어 요약을 함께 확인할 수 있습니다.
피드
트렌딩
태그
설정
Anthropic, 2층 Transformer에서 Induction Heads가 In-context Learning의 핵심임을 밝힌 수학적 프레임워크 공개
Hacker News
·
2
·
2026.09.12 22시
Anthropic, Jacobian Lens 오픈소스 공개
PyTorchKR 읽을거리
·
2026.07.22 20시
AI 에이전트 도구 사용의 해석 가능성 연구
Reddit
·
2026.07.19 22시
Coding agents think ahead of time
Hacker News
·
2026.07.14 21시
Anthropic, 모델 내부의 개념 형성 과정 포착
Reddit
·
2026.07.13 21시
LLM의 거절 행동을 유도하는 문맥 효과 발견
Reddit
·
2026.06.23 20시
LLM 정렬(Alignment)은 마지막 레이어에 집중된다
Reddit
·
2026.06.15 01시
숫자 없는 산술 – LLM이 수학을 수행하는 방식
Hacker News
·
2026.06.05 19시
LLM은 당신이 약속받았던 블랙박스가 아니다
Hacker News
·
2026.06.03 08시
LLM의 주관적 경험 보고 메커니즘 규명
Reddit
·
2026.05.29 00시
그래프 분석으로 grokking 조기 예측
Reddit
·
2026.05.19 23시
LLM의 가중치 내부에서 드러나는 정치 검열
TLDR AI
·
2026.05.19 09시
Natural Language Autoencoders: Claude의 생각을 텍스트로 바꾸기
GeekNews
·
2026.05.09 04시
Claude의 생각을 텍스트로 바꾸는 자연어 오토인코더
TLDR AI
·
2026.05.08 09시
Qwen3.5-27B용 SAE 해석모듈 공개
Reddit
·
2026.05.03 06시
Qwen-Scope 공식 SAE 공개
Reddit
·
2026.04.30 18시
거절회로의 실체
Reddit
·
2026.04.15 05시
대규모 언어 모델의 감정 개념과 그 기능
Anthropic Research
·
2026.04.02 00시
sparse circuits를 통한 신경망 이해
OpenAI Blog
·
2025.11.13 19시
#mechanistic-interpretability | AI Briefing