DocRaptor

DocRaptor превращает HTML, CSS и данные веб-приложения в многостраничные PDF с управляемой версткой: можно задавать формат и ориентацию страниц, колонтитулы, нумерацию, оглавление, закладки, интерактивные поля, печатные метки и структуру для программ чтения с экрана. Основной рабочий инструмент — запрос к API, в котором передают готовую разметку или адрес страницы, параметры рендеринга и режим обработки, а результат получают как файл, асинхронное задание либо размещенный документ.

PDF.co

PDF.co позволяет извлекать текст и таблицы из PDF, распознавать сканы, превращать документы в JSON, CSV, XML, Excel, HTML и изображения, объединять и разделять страницы, заполнять формы, добавлять текст, подписи и графику, а также встраивать эти операции в автоматические процессы через API. Для проверки запроса без написания программы служат API Tester, PDF Inspector, Document Parser, хранилище Files и журналы выполнения, поэтому один и тот же сценарий можно сначала отладить вручную, а затем перенести в код, Zapier, Make или n8n.

Free-OCR.com

Free-OCR.com извлекает печатный текст из JPG, JPEG, PNG, GIF, TIFF, BMP и первой страницы PDF: пользователь выбирает файл или указывает адрес изображения, отмечает язык распознавания, запускает обработку и получает редактируемый текст, который можно скопировать из поля результата либо сохранить как TXT. Сервис особенно удобен для отдельных сканов, фотографий страниц и снимков экрана, когда важнее быстро получить содержание, чем сохранить исходную верстку.

i2OCR

i2OCR помогает извлечь текст из фотографий, скриншотов, отсканированных страниц и PDF: пользователь выбирает язык, движок и схему макета, загружает файл, запускает распознавание, затем сверяет результат с оригиналом, копирует его или сохраняет в текстовый документ, Word, HTML либо PDF с поисковым слоем.

NewOCR

NewOCR извлекает печатный текст из сканов, фотографий, PDF, TIFF и DjVu, позволяет выбрать язык, повернуть страницу, ограничить область распознавания и обработать многоколоночную верстку, а готовый результат можно проверить в поле редактора и сохранить в TXT, DOC или PDF.

OnlineOCR.net

OnlineOCR.net распознаёт текст в сканированных PDF, фотографиях и графических файлах, а затем сохраняет результат в редактируемом виде: Word, Excel, обычный текст, RTF или PDF. Пользователь загружает документ, указывает язык, выбирает формат вывода и запускает конвертацию, поэтому сервис подходит для переноса договоров, таблиц, конспектов, счетов и архивных страниц без ручного перепечатывания.

OCR.space

OCR.space распознаёт печатный и рукописный текст на фотографиях, сканах и PDF, позволяет выбрать язык и OCR-движок, исправить поворот страницы, обработать таблицу или чек, проверить найденные слова на цветной накладке, получить обычный текст либо JSON и создать PDF с поисковым текстовым слоем. Для разовой задачи достаточно загрузить файл или указать его адрес, а повторяющуюся обработку можно перенести в API с теми же основными параметрами.