Atlas · GenAI 2026
Visual Document Retrieval
ColPali (vision-native document retrieval without OCR)
conceptPeak: 2025Multimodal RetrievalAI consensus: 0/3
Prerequisites
No prerequisites.
Recommended reference
Faysse et al. (2024) 'ColPali: Efficient Document Retrieval with Vision Language Models' — arXiv:2407.01449; foundational paper + HF blog post at huggingface.co/blog/manu/colpali
Notes from AI deep research
Anthropic Opus
ColPali (Faysse 2024): vision embeddings zamiast OCR. Drastycznie prostsze i szybsze
Related skills
- → is part of: Retrieval-Augmented Generation(3/3)
- → is subcategory of: Multimodal RAG(2/3)