AI Briefing
피드
안내
검색
EN
로그인
전체
피드·트렌딩·게시판 통합
피드
최신 뉴스
트렌딩
오픈소스·릴리즈
게시판
블로그·홍보
태그
주제별 탐색
#inference-speed
#inference-speed와 관련된 AI·개발 뉴스를 최신순으로 모았습니다. 원문 출처와 한국어 요약을 함께 확인할 수 있습니다.
피드
트렌딩
태그
설정
Inception, 초고속 LLM 'Mercury 2.5' 공개… 초당 770 토큰 생성
Hacker News
·
2026.09.24 07시
Qwen3.5-4B, 모델 그래프팅으로 프롬프트 처리 속도 최대 3.7배 향상
Reddit
·
2026.09.22 10시
확산 언어 모델(dLLM) 연구: 병렬 생성으로 AR 모델 속도 한계 극복 및 Mercury 2 등 상용화 동향
GeekNews
·
2026.09.22 09시
추천
Jev와 경쟁하는 오픈소스 의사결정 모델 Laya 공개... 6~8배 빠르고 할루시네이션 차단
Hacker News
·
1
·
2026.09.19 19시
IFM, K2-Horizon-7B 공개
Reddit
·
2026.09.18 03시
Cerebras, Qwen 3.8 27B 모델 초당 1,500토큰 속도로 제공
GeekNews
·
2026.09.04 06시
Multiverse Computing, 유럽 최고 성능 추론 모델 'Quasar 438B' 공개
Hacker News
·
2026.09.02 19시
DiffusionGemma 기술 보고서
Hacker News
·
2026.08.20 22시
llama.cpp, 프롬프트 처리 속도 최대 31% 향상
Reddit
·
2026.08.13 18시
llama.cpp, Bonsai 모델 추론 성능 개선
Reddit
·
2026.07.16 13시
Hugging Face-Cerebras, 실시간 음성 AI 파이프라인 공개
HuggingFace Blog
·
2026.07.01 09시
2023-2031년 모델 크기 스케일링 전망
TLDR AI
·
2026.06.23 09시
Xiaomi, MiMo V2.5Pro 공개
Reddit
·
2026.06.14 21시
추천
Mimo Tilert 1000tps
Xiaomi MiMo
·
2026.06.08 09시
Introspective Diffusion Language Models
TLDR AI
·
2026.04.15 09시
SDXL 추론 속도 및 메모리 최적화 가이드
HuggingFace Blog
·
2023.10.24 09시
#inference-speed | AI Briefing