AI Briefing

전문가에게 묻다: AI는 어떻게 시각적 검색을 이해하는가?

·2026.03.06 03:00

Google이 Gemini 모델을 활용해 이미지 내 여러 사물을 동시에 검색하는 멀티 오브젝트 시각적 검색 기능을 강화했다.

기존의 시각적 검색은 한 번에 하나의 아이템만 검색할 수 있는 방식이었다. 하지만 Circle to SearchLens의 업데이트를 통해, 이제 이미지 내 여러 객체를 동시에 식별하고 검색하는 것이 가능해졌다.

이 기능은 Gemini 모델의 멀티모달(multimodal) 역량을 기반으로 하는 AI Mode를 통해 구현된다. AI는 사용자의 질문과 이미지를 함께 분석하여 최적의 도구를 결정하며, 이미지 속의 여러 구성 요소를 동시에 찾아내어 하나의 응답으로 통합해 제공한다.

핵심은 fan-out 기술이다. AI 모델이 이미지 속 여러 사물을 파악한 뒤, 동시에 여러 검색을 실행하고 그 결과를 읽어 들여 단 몇 초 만에 일관된 답변을 생성한다.

사용자는 텍스트 검색으로 시작해 특정 이미지에 대해 추가 질문을 던지는 방식으로도 활용할 수 있어, 쇼핑부터 정보 탐색까지 폭넓은 활용이 가능하다.

이 요약은 원문 이해를 돕기 위한 큐레이션입니다. 저작권은 원저작자에게 있으며, 정확한 내용과 맥락은 원문을 확인하세요.

요약 오류, 출처 표기 문제, 삭제 요청은 문의 · 건의로 알려주세요.