AI Briefing
피드
안내
검색
EN
로그인
전체
피드·트렌딩·게시판 통합
피드
최신 뉴스
트렌딩
오픈소스·릴리즈
게시판
블로그·홍보
태그
주제별 탐색
#inference
#inference와 관련된 AI·개발 뉴스를 최신순으로 모았습니다. 원문 출처와 한국어 요약을 함께 확인할 수 있습니다.
피드
트렌딩
태그
설정
#inference 3페이지 | AI Briefing
Diffusers, Nunchaku 4비트 양자화 공식 지원
HuggingFace Blog
·
2026.07.23 09시
GPT-5.6 Sol, OpenRouter 지출 34% 점유
Reddit
·
2026.07.23 01시
LLM 난수 편향으로 API 진위 검증
Reddit
·
2026.07.22 16시
비용 효율적인 LLM 라우팅을 위한 온라인 학습
TLDR AI
·
2026.07.21 09시
Claude 모델별 가격 동향 분석
Reddit
·
2026.07.17 10시
llama.cpp, Tencent Hy3 모델 지원
Reddit
·
2026.07.14 11시
FTPO를 활용한 LLM 반복 생성 문제 해결
Reddit
·
1
·
2026.07.08 06시
Hugging Face Jobs로 vLLM 서버 즉시 구축
HuggingFace Blog
·
1
·
2026.06.26 05시
AI GPU의 수명은 3년보다 길 가능성이 높다
TLDR AI
·
2026.06.16 09시
Apple, MLX LM Server 공개
Reddit
·
2026.06.09 09시
샤오미의 MiMo, ChatGPT 및 Claude보다 15배 빠른 속도 구현
TLDR AI
·
2026.06.09 09시
NVIDIA 기술로 '주권적 AI' 야망을 실현 중인 영국
NVIDIA Blog
·
2026.06.08 15시
Groq는 어떻게 추가 자금을 조달하고 있는가?
Hacker News
·
2026.06.02 10시
vLLM, AMD용 HIP W4A16 커널 지원
Reddit
·
2026.05.29 21시
FuriosaAI, 에이전트 시대를 위한 차세대 추론 플랫폼 구축 위해 Broadcom과 협력
FuriosaAI
·
2026.05.27 23시
llama.cpp, MiniCPM5 지원 추가
Reddit
·
2026.05.27 14시
Qwen3.6 모델 성능 저하 버그
Reddit
·
1
·
2026.05.24 13시
AI 하드웨어에 대하여 (7분 읽기)
TLDR AI
·
2026.05.24 09시
Llama.cpp, PDL 지원 추가
Reddit
·
2026.05.23 06시
OWC, Thunderbolt 5 AI 하드웨어 출시
Reddit
·
2026.05.22 00시
TabPFN - 정형 데이터를 위한 파운데이션 모델
GeekNews
·
1
·
2026.05.21 09시
Qwen3.7-Max: agent frontier
GeekNews
·
2026.05.21 09시
Anthropic이 Colossus2로 확장한다. GB200을 사용한다
Hacker News
·
2026.05.21 05시
Qwen 3.6 35B GGUF 공개
Reddit
·
2026.05.21 00시
이전
1
2
3
4
5
다음
이전
1
2
3
4
5
6
7
다음