- Категория: Программы для работы с PDF
|
GNU Ocrad распознаёт печатный текст на сканах и растровых страницах, выводит результат в обычный байтовый текст или UTF-8, разделяет колонки и текстовые блоки, умеет обрабатывать выбранную область, менять масштаб, инвертировать изображение, настраивать порог бинаризации и передавать результат в файл, конвейер командной строки либо структурированный ORF-файл. |
- Категория: Программы для работы с PDF
|
Keras-OCR помогает находить текст на фотографиях и сканах, распознавать отдельные слова, получать координаты четырёхугольных областей, наносить подписи на изображение и обучать собственные модели детекции и распознавания через Python API. |
- Категория: Программы для работы с PDF
|
CnOCR извлекает текст с фотографий, сканов, чеков, билетов и снимков экрана, находит отдельные строки, возвращает координаты текстовых областей и оценку уверенности, а для однострочных изображений запускает ускоренное распознавание без этапа детектирования. |
- Категория: Программы для работы с PDF
|
MMOCR помогает находить текстовые области на изображениях, распознавать содержимое строк, объединять детектор и распознаватель в сквозной OCR‑конвейер и выделять ключевые поля в чеках или формах. Пользователь выбирает модель через MMOCRInferencer либо специализированный Inferencer, передаёт файл, массив NumPy или папку и получает координаты, строки, оценки уверенности, JSON‑совместимые результаты и визуализацию с рамками. |
- Категория: Программы для работы с PDF
|
Surya OCR распознаёт текст на страницах PDF и изображениях, находит строки и смысловые блоки, восстанавливает порядок чтения, выделяет таблицы и возвращает результат с координатами, метками структуры и HTML-разметкой. Инструменты командной строки и Python API позволяют обрабатывать один файл, выбранные страницы или целую папку, сохранять наглядные наложения и передавать структурированный JSON в поисковый индекс, систему извлечения данных или собственный конвертер документов. |
- Категория: Программы для работы с PDF
|
docTR распознаёт текст в PDF и изображениях, находит координаты каждого слова, собирает результат по страницам, строкам и блокам и отдаёт его как обычный текст, JSON, HTML, XML или разметку для дальнейшей обработки. С помощью готовых моделей можно анализировать отсканированные договоры, счета, анкеты и фотографии документов, учитывать поворот страниц, выделять области макета и таблицы, а затем встроить полученные данные в Python-скрипт, API или пакетную очередь. |
- Категория: Программы для работы с PDF
|
Calamari OCR распознаёт заранее выделенные строки печатного или рукописного текста, обучает собственные нейросетевые модели на парах изображение — расшифровка, объединяет прогнозы нескольких моделей голосованием и измеряет качество по CER и таблице ошибок. Основные операции выполняются командами calamari-predict, calamari-train, calamari-cross-fold-train и calamari-eval, а Python API позволяет встроить тот же конвейер в скрипт обработки документов. |
Страница 244 из 856






