- Категория: Программы для работы с PDF
|
Pix2Text распознаёт текст, математические формулы, таблицы и структуру страниц на изображениях и в PDF, собирает результат в Markdown с LaTeX-разметкой и позволяет обрабатывать отдельные фрагменты, сложные страницы или выбранные листы документа через командную строку и Python API. |
- Категория: Программы для работы с PDF
|
LayoutParser помогает разбирать страницы PDF и изображений на текстовые блоки, заголовки, списки, таблицы и иллюстрации, связывать найденные области с OCR, фильтровать их по координатам и сохранять результат в JSON, CSV или объектную структуру для дальнейшей обработки. |
- Категория: Программы для работы с PDF
|
Donut извлекает из изображений документов структурированные поля, определяет тип страницы и отвечает на вопросы по её содержимому без отдельного этапа классического OCR. Пользователь подаёт скан или фотографию, выбирает контрольную точку под нужную задачу, задаёт служебный запрос и получает последовательность, которую можно преобразовать в JSON для учётной системы, поиска, проверки чеков или маршрутизации входящих документов. |
- Категория: Программы для работы с PDF
|
TrOCR распознаёт печатные строки, рукописные записи и текст на отдельных изображениях: пользователь подготавливает кадр с одной строкой, передаёт его через TrOCRProcessor в модель, запускает генерацию и получает обычный текст, который можно проверить, сохранить или включить в обработку сканов PDF. |
- Категория: Программы для работы с PDF
|
EffOCR распознаёт печатный текст на сканах, выделяет строки, слова и отдельные символы, сопоставляет найденные фрагменты с визуальным индексом и возвращает текст вместе с координатами областей. Главные инструменты — готовые модели для инференса, модульная настройка локализатора и распознавателя, обучение на собственных COCO-аннотациях, визуальная проверка рамок и экспорт результатов для дальнейшей обработки. |
- Категория: Программы для работы с PDF
|
GNU Ocrad распознаёт печатный текст на сканах и растровых страницах, выводит результат в обычный байтовый текст или UTF-8, разделяет колонки и текстовые блоки, умеет обрабатывать выбранную область, менять масштаб, инвертировать изображение, настраивать порог бинаризации и передавать результат в файл, конвейер командной строки либо структурированный ORF-файл. |
- Категория: Программы для работы с PDF
|
Keras-OCR помогает находить текст на фотографиях и сканах, распознавать отдельные слова, получать координаты четырёхугольных областей, наносить подписи на изображение и обучать собственные модели детекции и распознавания через Python API. |
Страница 38 из 650






