PDFid

PDFid быстро проверяет PDF-файл без его открытия в просмотрщике: показывает заголовок документа, считает объекты, потоки, страницы и маркеры конца файла, отмечает JavaScript, автоматические действия, вложения, шифрование и другие конструкции, а режимы дополнительной статистики, пользовательских индикаторов и пакетной обработки помогают решить, какой образец нужно разбирать глубже.

pdf-parser

pdf-parser помогает разобрать PDF на отдельные объекты, словари, ссылки и потоки, найти JavaScript, автоматические действия, вложения и подозрительные ключи, распаковать поддерживаемые фильтры, извлечь выбранное содержимое и подготовить структурированные результаты для дальнейшего анализа.

pdf2htmlEX

pdf2htmlEX преобразует страницы PDF в HTML с сохранением расположения текста, встроенных шрифтов, ссылок, иллюстраций и сложной верстки; диапазон страниц, масштаб, формат фона, способ внедрения ресурсов и разбиение документа на отдельные файлы задаются параметрами команды.

pdfbook2

pdfbook2 переставляет страницы обычного PDF в печатные развороты брошюры, автоматически подрезает лишние поля, добавляет запас у сгиба и внешних краёв, выбирает формат листа и формирует файл, который можно вывести с двух сторон, сложить пополам и сшить по центру. Основная работа выполняется одной командой, а параметры позволяют отдельно управлять внутренним, наружным и верхним полями, отключать обрезку, задавать размер сигнатуры и готовить листы под переворот по короткой кромке.

pdfjam

pdfjam помогает собрать несколько PDF и изображений в один документ, выбрать нужные страницы, поменять их порядок, разместить несколько исходных листов на одном печатном, подготовить буклет или тетради для переплёта, повернуть, масштабировать и обрезать содержимое. Основные действия задаются параметрами команды: диапазоном страниц, схемой N-up, форматом бумаги, полями, рамками, смещением и именем выходного файла.

pdfgrep

pdfgrep позволяет находить слова, фразы и регулярные выражения внутри одного PDF или целой папки документов, сразу показывать имя файла, номер страницы и строку с совпадением, считать найденные места, выводить контекст и передавать результат другим командам. Основные инструменты вызываются из терминала: шаблон задаётся прямо в команде или читается из файла, область поиска ограничивается списком страниц и масками имён, а для повторной обработки больших документов можно включить кэш извлечённого текста.

Book Scan Wizard 2

Book Scan Wizard 2 помогает превратить серии фотографий книжных разворотов в ровные, одинаково масштабированные страницы: в программе можно сопоставить кадры левой и правой камер, исправить перспективу и поворот, задать обрезку и DPI, выровнять освещение, очистить изображение и собрать результат в PDF либо сохранить страницы в TIFF, JPEG, JPEG 2000 или PNG.