AI Briefing
피드
안내
개발
검색
로그인
전체
피드·트렌딩·게시판 통합
피드
최신 뉴스
주간
주간·월간 인기
트렌딩
오픈소스·릴리즈
게시판
블로그·홍보
태그
주제별 탐색
#llm-research
피드
트렌딩
주간
태그
설정
주요 LLM에서 'Zero-Byte' 출력 현상 발견
Reddit
·
1
·
2026.07.31 07시
MoE 모델의 라우팅 전문가 28% 제거해도 성능 유지
Reddit
·
2026.07.25 21시
Anthropic, 에이전트 정렬 실패 사례 연구
Reddit
·
2026.07.16 04시
Pangram 3.3.2의 내부 표현 탐색
Hacker News
·
2026.06.25 10시
VibeThinker: 새로운 SFT+GRPO 방식을 통해 추론 능력에서 Opus 4.5를 능가하는 3B 파라미터 모델
Hacker News
·
2026.06.23 11시
Transformer에 세 개의 프로젝션이 꼭 필요할까? QKV 변형에 대한 체계적 연구
Hacker News
·
2026.06.05 08시
에이전트 노화 측정, AgingBench 공개
Reddit
·
2026.05.29 02시
오픈 LLM 최대 활성값 측정
Reddit
·
2026.05.19 21시
AI 에이전트의 가상 사회 실험 결과
Reddit
·
2026.05.18 02시
MOOSE-Star 7B 공개
Reddit
·
2026.05.15 02시
중국 AI 연구소 내부에서 얻은 교훈
GeekNews
·
2026.05.14 10시
Anthropic, 모델 내부 사고 읽는 NLA 기술
Reddit
·
2026.05.08 16시
1931년 이전 데이터 학습 13B 모델 Talkie
Reddit
·
2026.04.29 01시
Infini-Attention 실험 결과: 긴 문맥 확장의 한계와 대안
HuggingFace Blog
·
2024.08.14 09시