Atlas · GenAI 2026
Optical Character Recognition (OCR)
Turning page images into text and layout — the first step of most document pipelines.
conceptPeak: 2022Data IngestionAI consensus: 3/3
Prerequisites
No prerequisites.
Recommended reference
tesseract-ocr.github.io — official docs
Notes from AI deep research
Anthropic Opus
Ślad n=358; wejście do większości potoków dokumentowych, dziś wypierane przez modele wizyjne
OpenAI Deep Research
OCR ewoluuje w rozumienie dokumentów multimodalnych, więc kompetencja obejmuje dziś układ, tabele i kontrolę halucynacji [OA]
Google Deep Think
Mimo rozwoju modeli wielomodalnych OCR pozostaje szybkim i niezawodnym etapem ekstrakcji danych ze złożonych dokumentów [G]
Related skills
- → is subcategory of: Document Parsing(0/3)