Відкрийте PDF у JSON, щоб експортувати записи сторінок, текстові блоки та дані креслень. Наш чотиристорінковий PDF створює document.json плюс одне посилане PNG-зображення всередині ZIP.
Виберіть сторінки PDF
Завантажте PDF і залиште Сторінки порожніми для всього документа або введіть потрібний піддіапазон. Наш приклад включає всі чотири сторінки.
Експортуйте та тримайте ресурси разом
Виберіть Почати. Експорт із графічними ресурсами завантажується як ZIP. Розпакуйте весь архів і тримайте каталог images поруч із document.json.
Зразок містить images/page-001-image-005.png. Посилання на зображення вказують на шляхи до ресурсів, а не вбудовують бінарні дані в JSON. Експорт без графічних ресурсів можна завантажити безпосередньо як .json.
Прочитайте структуру документа
Зразок оголошує версію 1, одиниці вимірювання pt та початок координат зверху-зліва. Записи сторінок включають номер вихідної сторінки, розміри, поворот, блоки та креслення. Координати описують сторінку без повороту; враховуйте поворот при накладанні даних.
Обробіть JSON за допомогою парсера JSON. Перевірте блоки, рядки та діапазони для тексту та стилізації, а також значення bbox для геометрії. Вкладені об'єкти описують макет, а не просто один текстовий рядок.
Перевірте порядок читання та посилання на зображення порівняно з оригінальним PDF перед використанням даних у вашому робочому процесі обробки.
Поширені запитання
Чи можу я точно відтворити оригінальний PDF?
Не припускайте точну реконструкцію «туди і назад». Експорт описує доступний вміст і геометрію, тоді як функції та семантика PDF можуть бути складнішими.
Чому я отримав ZIP?
Зразок містить зображення. ZIP зберігає document.json і посиланий ресурс разом, щоб зображення можна було знайти.
Спробуйте зі своїм документом
Перегляньте результат, а потім збережіть потрібну версію.

