AI Briefing
피드
안내
검색
EN
로그인
전체
피드·트렌딩·게시판 통합
피드
최신 뉴스
트렌딩
오픈소스·릴리즈
게시판
블로그·홍보
태그
주제별 탐색
#vision-language-model
#vision-language-model와 관련된 AI·개발 뉴스를 최신순으로 모았습니다. 원문 출처와 한국어 요약을 함께 확인할 수 있습니다.
피드
트렌딩
태그
설정
#vision-language-model 3페이지 | AI Briefing
Qwen3.5: 네이티브 멀티모달 에이전트를 향해
Qwen
·
2026.02.16 05시
HyperCLOVA X OMNI: 국가대표 AI, 옴니모달을 향한 여정
NAVER CLOVA
·
2026.01.05 00시
Stable Cinemetrics: 전문 영상 생성을 위한 구조적 분류체계와 평가
Stability AI Research
·
2025.10.02 00시
파인튜닝을 통한 위성 이미지 분야 시각 언어 모델의 잠재력 극대화
Mistral AI
·
2025.08.01 09시
HuggingFace, VLM 학습용 nanoVLM 공개
HuggingFace Blog
·
2025.05.21 09시
VLM 기술 트렌드 및 최신 모델 동향 정리
HuggingFace Blog
·
2025.05.12 09시
멀티모달 모델 Visual Salamandra 공개
HuggingFace Blog
·
2025.04.11 23시
Qwen2.5 Omni: 보고, 듣고, 말하고, 쓰는 올인원 멀티모달 모델
Qwen
·
2025.03.27 01시
Google, SigLIP 2 비전-언어 인코더 공개
HuggingFace Blog
·
2025.02.21 09시
HuggingFace, 초경량 비디오 이해 모델 SmolVLM2 공개
HuggingFace Blog
·
2025.02.20 09시
Google, PaliGemma 2 Mix 공개
HuggingFace Blog
·
2025.02.19 09시
Qwen2.5-VL 공개!
Qwen
·
2025.01.26 20시
smolagents, VLM 지원으로 시각 기능 추가
HuggingFace Blog
·
2025.01.24 09시
QVQ: 지혜로운 시각으로 세상을 바라보다
Qwen
·
2024.12.25 01시
Google, 차세대 VLM PaliGemma 2 출시
HuggingFace Blog
·
2024.12.05 09시
카카오, 멀티모달 언어모델 Kanana-v 공개… 한국어 OCR 성능 GPT-4o 능가
카카오
·
2024.12.05 00시
Meta, Llama 3.2 멀티모달·온디바이스 모델 공개
HuggingFace Blog
·
2024.09.25 09시
Pixtral 12B 공개
Mistral AI
·
2024.09.17 09시
Qwen2-VL: 세상을 더 명확하게 이해하다
Qwen
·
2024.08.29 01시
LLM 기반 VQA 평가 지표 LAVE 제안
HuggingFace Blog
·
2024.07.25 09시
DocVQA용 대규모 데이터셋 Docmatix 공개
HuggingFace Blog
·
2024.07.18 09시
Florence-2, DocVQA 미세 조정 가이드
HuggingFace Blog
·
2024.06.24 09시
Google, 오픈 VLM PaliGemma 공개
HuggingFace Blog
·
2024.05.14 09시
Gaudi2, BridgeTower 미세 조정 2.5배 가속
HuggingFace Blog
·
2023.06.29 09시
이전
1
2
3
4
다음
이전
1
2
3
4
다음