AI Briefing
피드
안내
개발
검색
로그인
전체
피드·트렌딩·게시판 통합
피드
최신 뉴스
주간
주간·월간 인기
트렌딩
오픈소스·릴리즈
게시판
블로그·홍보
태그
주제별 탐색
#multimodal-llm
피드
트렌딩
주간
태그
설정
멀티모달 LLM의 얼라인먼트 이해: 종합 연구
Apple ML
·
2026.08.03 09시
Moonshot AI, 2.8T 규모 Kimi K3 오픈 웨이트 공개
PyTorchKR 읽을거리
·
2026.07.29 09시
Swiss-AI, 멀티모달 지원 Apertus-v1.5 공개
Reddit
·
2026.07.24 15시
1T 파라미터급 멀티모달 모델 Inkling 출시
HuggingFace Blog
·
2026.07.15 09시
상형문자 번역 모델 Horus Hiero 공개
Reddit
·
2026.07.08 15시
Gemma 4 기술 보고서 (17분 분량)
TLDR AI
·
2026.07.08 09시
NVIDIA, 오디오-텍스트 통합 LLM Audex-30B 공개
Reddit
·
1
·
2026.07.07 16시
추천
Qwen-RobotNav: 에이전트 기반 내비게이션 시스템을 위해 설계된 확장 가능한 내비게이션 모델
Qwen
·
2026.06.16 09시
SenseNova U1, 인포그래픽 특화 모델 공개
Reddit
·
2026.06.11 00시
MiniMax-M3 데뷔, 주요 벤치마크 성능에서 GPT-5.5와 Gemini 3.1 Pro를 능가하며 비용은 단 5-10% 수준
GeekNews
·
2026.06.02 16시
추천
Qwen-VLA: 세상을 이해하는 것을 넘어 직접 행동하기까지
Qwen
·
1
·
2026.05.29 18시
IEEE/CVF 컴퓨터 비전 및 패턴 인식 컨퍼런스 (CVPR) 2026
Apple ML
·
2026.05.28 09시
Ovis2.6 80B-A3B 공개
Reddit
·
2026.05.13 21시
AI는 투자 설명서(Investor Deck)를 읽지 못한다
TLDR AI
·
2026.04.08 09시
“생각하고 답변하는” 카카오의 하이브리드 멀티모달 언어모델, Kanana-v-4b-hybrid 개발기
카카오
·
2026.01.05 00시
카카오의 경량 멀티모달 언어모델 ‘Kanana-1.5-v-3b’ 개발부터 공개까지
카카오
·
2025.07.24 00시
Qwen2.5-VL-32B: 더 똑똑하고 가벼워진 모델
Qwen
·
2025.03.24 01시
Big Bench Audio 벤치마크 공개
HuggingFace Blog
·
2024.12.20 09시
HuggingFace, CinePile 2.0 공개
HuggingFace Blog
·
2024.10.23 09시
Qwen2-Audio: 목소리로 대화하기
Qwen
·
2024.08.09 17시