AI Briefing

LlamaIndex 뉴스레터 2024-02-20: LlamaCloud 소개

·2024.02.21 02:12

LlamaIndex가 관리형 parsing·ingestion·retrieval 서비스 LlamaCloud를 공개했다.

LlamaCloud가 공개되며, LLM과 RAG 애플리케이션을 위한 production-grade context augmentation 인프라가 새로 제시됐다.

핵심 구성은 두 가지다.

  • LlamaParse: 표와 그림이 포함된 복잡한 문서를 처리하는 특화 parsing 서비스로, semi-structured 문서 대응을 강화한다.
  • Managed Ingestion and Retrieval API: 데이터 로딩, 처리, 저장을 단순화해 RAG 파이프라인 운영 부담을 줄인다.

연동 범위도 넓다. LlamaHub를 통해 150개 이상 데이터 소스와 40개 이상 데이터 저장소를 지원하며, 기업용 워크플로에 맞춘 확장성을 강조했다.

출시 단계는 서비스별로 다르다. LlamaParse는 현재 public preview이며 PDF에 우선 집중하고, 공개 사용자는 사용량 제한이 있다. 상용 조건은 별도 문의가 필요하고, Managed API는 private preview로 일부 엔터프라이즈 파트너에게만 제공된다.

이번 뉴스레터의 하이라이트도 함께 정리됐다.

  • Corrective RAG LlamaPack: CRAG 논문 아이디어를 반영해 검색 결과의 정확도와 관련성을 높인다.
  • SELF-DISCOVER LlamaPack: 메타-추론 기반의 문제 해결 방식을 LlamaPack으로 구현했다.
  • RAG Production Guide: JasperAI의 Sisil Mehta가 소개하는 운영 중심 RAG 가이드가 공개됐다.

데모와 튜토리얼, 가이드도 다수 소개됐다. DanswerAI의 엔터프라이즈 지식 통합 사례, ADU Planning용 멀티모달 앱, 벡터 임베딩 설정, 연구용 RAG 에이전트, LlamaIndex v0.10 소개, Query Pipeline으로 에이전트 만들기, Ollama 기반 멀티모달 앱 구축, RAG 평가와 SageMaker 배포 사례까지 폭넓게 다뤘다.

이 요약은 원문 이해를 돕기 위한 큐레이션입니다. 저작권은 원저작자에게 있으며, 정확한 내용과 맥락은 원문을 확인하세요.

요약 오류, 출처 표기 문제, 삭제 요청은 문의 · 건의로 알려주세요.