pdfresurrect

В pdfresurrect можно определить, сколько инкрементальных редакций хранится внутри PDF, вывести изменения по объектам, посмотреть сохранённые метаданные создателя и извлечь каждое прежнее состояние в отдельный файл. Основные инструменты — обычный анализ без параметров, быстрый счётчик -q, режим записи -w и вывод сведений -i; вместе они помогают проверить историю договора, отчёта или формы, не изменяя исходный документ.

peepdf

peepdf помогает разобрать подозрительный PDF до уровня объектов, потоков, ссылок и встроенного JavaScript: пользователь получает сводку структуры, находит действия открытия и вложения, сравнивает ревизии документа, смотрит сырые и декодированные данные, извлекает нужный фрагмент и сохраняет результаты анализа без запуска содержимого в программе чтения PDF.

pdfposter

pdfposter увеличивает или уменьшает страницы PDF, рассчитывает сетку печатных листов и создаёт новый многостраничный PDF, из которого можно собрать плакат, баннер, выкройку, карту или крупную схему. Размер результата задаётся форматом плаката, точным коэффициентом масштаба либо количеством листов через геометрию BOX; отдельные параметры выбирают размер бумаги, диапазон исходных страниц, TrimBox или ArtBox, а подробный режим заранее показывает масштаб, поворот и раскладку.

pdfcpu

pdfcpu позволяет проверять структуру PDF, объединять и разделять документы, переставлять и удалять страницы, оптимизировать ресурсы, добавлять штампы и водяные знаки, управлять вложениями, формами, закладками, паролями и разрешениями. Все операции задаются командами с явными входными и выходными файлами, поэтому один и тот же рабочий процесс легко повторить для одного документа, целой папки или автоматического сценария.

jsPDF

jsPDF создаёт PDF-документы из JavaScript-кода: выводит текст и векторную графику, добавляет изображения, страницы, ссылки и поля форм, настраивает формат листа, шрифты, метаданные и сохраняет результат в файл, Blob, ArrayBuffer или строку данных.

HummusJS

HummusJS позволяет из Node.js создавать PDF с текстом, изображениями и векторной графикой, дописывать содержимое на существующие страницы, объединять документы, копировать отдельные объекты и разбирать внутреннюю структуру файла через программный API.

PP-Structure

PP-Structure разбирает PDF и изображения страниц на заголовки, абзацы, таблицы, формулы, рисунки, печати и служебные области, распознаёт текст, восстанавливает порядок чтения и сохраняет результат в Markdown, JSON, Word, HTML или XLSX. Пользователь может включать выравнивание снимка, определение поворота, распознавание таблиц и формул, получать координаты каждого блока и собирать многостраничный документ в структуру, пригодную для поиска, долговременного хранения, RAG-системы или последующей проверки.