AI Briefing
피드
안내
검색
EN
로그인
전체
피드·트렌딩·게시판 통합
피드
최신 뉴스
트렌딩
오픈소스·릴리즈
게시판
블로그·홍보
태그
주제별 탐색
#model-architecture
#model-architecture와 관련된 AI·개발 뉴스를 최신순으로 모았습니다. 원문 출처와 한국어 요약을 함께 확인할 수 있습니다.
피드
트렌딩
태그
설정
Stanford·NVIDIA, 추론 속도 9배 개선한 '대조 언어 모델' CLM 공개
Hacker News
·
2026.09.24 13시
확산 언어 모델(dLLM) 연구: 병렬 생성으로 AR 모델 속도 한계 극복 및 Mercury 2 등 상용화 동향
GeekNews
·
2026.09.22 09시
트랜스포머 성능, 배치보다 메커니즘 다양성이 핵심
PyTorchKR 읽을거리
·
1
·
2026.09.18 12시
OpenWAM, 로봇 WAM 설계 비교용 오픈소스 스택 공개
PyTorchKR 읽을거리
·
1
·
2026.09.14 09시
YOLO26 백본 기반 비우개 모델 공개
Reddit
·
1
·
2026.09.02 00시
GLM-5.3, HF Viewer 시각화 공개
Reddit
·
2026.08.29 05시
Qwen4Exp, N-gram 아키텍처 분석
Reddit
·
4
·
2026.08.27 11시
Qwen3.8-27B 성능 및 아키텍처 분석
Reddit
·
2026.08.15 06시
AWS Trainium의 프론티어 경쟁: 목적 특화 AI 칩에서 모델과 커널 공동 설계
Amazon Science
·
2026.08.11 05시
AFM3 20B, MLP 20% 활성화
Reddit
·
1
·
2026.08.04 10시
Neutrino-1 8B
Hacker News
·
2026.07.28 13시
Liquid AI, 토크나이저 재학습 없이 확장
Reddit
·
2026.07.22 19시
Multi-Stream LLMs: Thoughts, Inputs, Outputs의 병렬 스트림으로 언어 모델의 병목을 해소하다
Hacker News
·
2026.05.22 04시
가중치 수정 없는 LLM 수평적 확장 기술
Reddit
·
2026.05.18 22시
Orthrus-Qwen3: Qwen3에서 최대 7.8배 tokens/forward, 동일한 출력 분포
Hacker News
·
2026.05.16 07시
인터랙션 모델
TLDR AI
·
2026.05.12 09시
Interfaze: 대규모 환경에서 높은 정확도를 내는 새로운 모델 아키텍처
Hacker News
·
2026.05.12 01시
SATFormer: 효율적인 표현 재사용 구조
Reddit
·
2026.05.06 10시
SenseNova U1 오픈소스 공개
Reddit
·
2026.05.06 00시
Mixture of Experts(MoE)란 무엇인가 — DeepSeek이 왜 1.6조 파라미터인데도 싸게 돌아가는지
GeekNews
·
2026.04.27 13시
조기융합 승부
HuggingFace Blog
·
2026.04.01 16시
#model-architecture | AI Briefing