Автономный режим • Обработка на 100% выполняется локально

Парсер PDF

Прочитайте метаданные, шрифты, количество объектов и структуру PDF, а затем выгрузите отчёт в JSON или CSV.

Что читает парсер PDF?

Словарь информации о документе и любой пакет XMP — заголовок, автор, тема, ключевые слова, производитель, программа-создатель и даты, — а также структуру: версию PDF, число страниц, шифрование, быстрый веб-просмотр, имена и количество встроенных шрифтов, количество объектов-изображений, формы, действия JavaScript и вложения.

Извлекает ли он сами изображения и шрифты?

Нет. Он сообщает, какие шрифты встроены в документ и сколько в нём объектов-изображений, но не вытаскивает эти ресурсы отдельными файлами.

Можно ли выгрузить отчёт?

Да — полный список полей скачивается в JSON или CSV и формируется в браузере из открытого вами файла. При этом никуда ничего не отправляется.