AI Briefing
피드
안내
검색
EN
로그인
전체
피드·트렌딩·게시판 통합
피드
최신 뉴스
트렌딩
오픈소스·릴리즈
게시판
블로그·홍보
태그
주제별 탐색
#llm-architecture
#llm-architecture와 관련된 AI·개발 뉴스를 최신순으로 모았습니다. 원문 출처와 한국어 요약을 함께 확인할 수 있습니다.
피드
트렌딩
태그
설정
WarpState, 이중 메모리 기반 장문 LLM 아키텍처 공개
Reddit
·
2026.09.21 23시
실시간 데이터로 가중치 생성·적응하는 '무한 파라미터 LLM' 아키텍처 제안
Hacker News
·
2026.09.18 01시
현대 LLM 아키텍처의 PyTorch 학습용 구현 모음 'OpenArch' 공개
GeekNews
·
2026.09.15 01시
2019-2025 사전학습 진보 분석: 데이터 개선이 모델 개선보다 3배 큰 기여
TLDR AI
·
2026.09.09 01시
ZEP, Amazon Bedrock AgentCore 기반 LangGraph로 교육용 퀴즈 생성 아키텍처 고도화
AWS Tech Blog (한국)
·
1
·
2026.08.31 15시
알리바바, Qwen4 아키텍처 미리 공개… 125B 중 6B만 활성화
TLDR AI
·
2026.08.27 09시
커스터마이징을 위해 설계된 새로운 미국산 AI 모델
TLDR AI
·
2026.08.19 09시
지식과 추론을 분리해 효율을 높인 Intern-S2-Mobius 공개
Reddit
·
2026.08.17 21시
새로운 희소 주의 집중 아키텍처 DWARF 공개
Reddit
·
2026.07.21 01시
추천
Qwen 팀, 헤드 단위 하이브리드 Attention 'HydraHead' 공개
Reddit
·
2026.06.30 21시
하이브리드 모델의 토큰 예측 특성 분석
HuggingFace Blog
·
2026.06.26 01시
GLM-5.2 공개: 1M 컨텍스트와 코딩 성능 강화
HuggingFace Blog
·
2026.06.17 18시
AI 이후의 소프트웨어: 하네스(Harness) 시대의 개막
GeekNews
·
2026.06.01 09시
Parallax: 새로운 어텐션 기술
Reddit
·
2026.05.31 03시
추론 모델의 구조적 한계: Verbosity ≠ Faithfulness
Reddit
·
2026.05.27 00시
Delta Attention Residuals 공개
Reddit
·
2026.05.26 01시
LLM 아키텍처의 최근 동향: KV 공유, mHC, 그리고 압축 어텐션
GeekNews
·
1
·
2026.05.23 09시
장기 실행 에이전트 - 에이전트가 며칠 동안 실행되면 무엇이 달라지는가
GeekNews
·
2026.05.04 15시
MoE vs Dense 모델 성능 직접 비교
Reddit
·
2026.04.28 16시
OpenMythos: 공개 연구로 복원한 Claude Mythos 아키텍처 가설인가, 또 다른 AI 하이프인가
GeekNews
·
2026.04.25 02시
MoE(Mixture of Experts) 핵심 정리
HuggingFace Blog
·
2023.12.11 09시
#llm-architecture | AI Briefing