Nougat OCR

Nougat OCR преобразует страницы научных PDF в разметку MMD: извлекает связный текст, сохраняет формулы в LaTeX, восстанавливает таблицы и формирует структуру с заголовками, списками и ссылками на литературу. Пользователь задаёт один файл, набор страниц или целую папку, выбирает модель и размер пакета, а затем проверяет готовый файл .mmd по маркерам пропущенных страниц и сложным фрагментам оригинала.

marker-pdf

marker-pdf преобразует PDF и изображения в структурированный Markdown, HTML, JSON или плоские блоки для RAG: распознаёт текст, колонки, таблицы, формулы, код и иллюстрации, удаляет повторяющиеся колонтитулы и позволяет обрабатывать отдельные страницы, папки документов или только найденные таблицы.

MinerU

MinerU превращает PDF, сканы и офисные документы в структурированный Markdown и JSON: распознаёт текст, восстанавливает порядок чтения, выделяет заголовки, абзацы, таблицы, формулы и иллюстрации, а затем сохраняет результат вместе с изображениями и диагностической разметкой. Пользователь может обработать один файл через наглядную форму, запустить пакетное преобразование командой, встроить разбор в Python-код или передать документы через API; для проверки результата предусмотрены предпросмотр страниц, визуализация областей макета и отдельные файлы с координатами найденных элементов.

Mathpix Snip

Mathpix Snip помогает захватить формулу, фрагмент научной статьи, таблицу, рукописную запись или химическую структуру прямо с экрана, распознать содержимое и сразу получить код LaTeX, MathML, Markdown, текст для Word, табличные данные либо SMILES. Основные инструменты сосредоточены вокруг прямоугольного снимка области, истории распознаваний, вкладок с разными представлениями результата, встроенной правки и копирования в буфер обмена, поэтому путь от изображения до редактируемого материала обычно занимает несколько действий.

RapidOCR

RapidOCR распознаёт текст на фотографиях, сканах и отдельных страницах документов: находит строки, определяет их ориентацию, возвращает текст, координаты, уверенность и время обработки, а затем сохраняет наглядное изображение с рамками. Через Python и командную строку можно выбрать модели, движок вычислений и уровень детализации, включая координаты отдельных символов.

InvoiceCapture

InvoiceCapture помогает превратить входящие счета в проверенные данные для учётной системы: программа принимает сканы и электронные файлы, очищает изображения, распознаёт поставщика, номер и дату счёта, суммы, налоги, заказ на поставку и строки товаров, показывает документ рядом с извлечёнными полями, применяет правила проверки и передаёт результат в ERP или другой рабочий процесс.

Square 9 GlobalCapture

Square 9 GlobalCapture принимает сканы, PDF-файлы, вложения электронной почты и данные из подключённых источников, распознаёт и классифицирует документы, извлекает реквизиты, направляет спорные результаты на ручную проверку и выпускает обработанные материалы в папку или архив. Основная работа строится вокруг графического Designer с узлами процесса, Template Designer с зонами OCR, Batch Manager для контроля очередей и Validation Station для исправления полей и страниц.