Åbn PDF til JSON for at eksportere sideregistreringer, tekstblokke og tegnedata. Vores PDF på fire sider genererer document.json plus ét refereret PNG-billede inde i en ZIP-fil.
Vælg PDF-siderne
Indlæs PDF'en og lad Sider stå tom for hele dokumentet, eller indtast det undersæt, du har brug for. Vores eksempel inkluderer alle fire sider.
Eksportér og hold aktiverne samlet
Vælg Start. En eksport med billedaktiver downloades som ZIP. Udpak hele arkivet og behold images-mappen ved siden af document.json.
Eksemplet inkluderer images/page-001-image-005.png. Billedreferencer peger på aktivstier i stedet for at indlejre binære data i JSON-filen. En eksport uden billedaktiver kan downloades direkte som .json.
Læs dokumentstrukturen
Eksemplet erklærer version 1, enheder pt og en top-venstre oprindelse. Sideregistreringer inkluderer kildesidenummer, dimensioner, rotation, blokke og tegninger. Koordinater beskriver den uroterede side; tag højde for rotation, når du lægger dataene ovenpå.
Analysér JSON-filen med en JSON-parser. Inspicér blokke, linjer og spænd for tekst og formatering, samt bbox-værdier for geometri. Indlejrede objekter beskriver layoutet frem for en enkelt tekststreng.
Tjek læserækkefølge og billedreferencer mod den originale PDF, før du bruger dataene i din behandlingsarbejdsgang.
Almindelige spørgsmål
Kan jeg genskabe den originale PDF nøjagtigt?
Antag ikke en nøjagtig rekonstruktion. Eksporten beskriver tilgængeligt indhold og geometri, mens PDF-funktioner og semantik kan være mere komplekse.
Hvorfor modtog jeg en ZIP-fil?
Eksemplet indeholder et billede. ZIP-filen holder document.json og det refererede aktiv samlet, så billedet kan findes.
Prøv det med dit dokument
Gennemgå resultatet, og gem derefter den version, du har brug for.

