Deschide PDF to JSON pentru a exporta înregistrările paginilor, blocurile de text și datele de desenare. PDF-ul nostru de patru pagini produce document.json plus o imagine PNG referențiată în interiorul arhivei ZIP.
Alege paginile PDF
Încarcă PDF-ul și lasă Pages gol pentru întregul document sau introdu subsetul de care ai nevoie. Exemplul nostru include toate cele patru pagini.
Exportă și păstrează resursele împreună
Alege Start. Un export cu resurse de imagine se descarcă sub formă de ZIP. Extrage întreaga arhivă și păstrează directorul images lângă document.json.
Exemplul include images/page-001-image-005.png. Referințele de imagine indică spre căile resurselor în loc să includă date binare în JSON. Un export fără resurse de imagine se poate descărca direct ca .json.
Citește structura documentului
Exemplul declară versiunea 1, unitățile pt și o origine top-left. Înregistrările paginilor includ numărul paginii sursă, dimensiunile, rotația, blocurile și desenele. Coordonatele descriu pagina nerotită; ține cont de rotație atunci când suprapui datele.
Analizează JSON-ul cu un parser JSON. Inspectează blocurile, liniile și segmentele pentru text și stilizare, precum și valorile bbox pentru geometrie. Obiectele imbricate descriu layout-ul, nu un singur șir de text.
Verifică ordinea de citire și referințele imaginilor față de PDF-ul original înainte de a utiliza datele în fluxul tău de procesare.
Întrebări frecvente
Pot reconstrui exact PDF-ul original?
Nu presupune o reconstrucție exactă de tip round-trip. Exportul descrie conținutul și geometria disponibile, în timp ce caracteristicile și semantica PDF pot fi mai complexe.
De ce am primit un ZIP?
Exemplul conține o imagine. ZIP-ul păstrează document.json și resursa referențiată împreună, astfel încât imaginea să poată fi localizată.
Încearcă cu documentul tău
Revizuiește rezultatul, apoi salvează versiunea de care ai nevoie.

