Åpne PDF til JSON for å eksportere sideoppføringer, tekstblokker og tegnedata. Vår firesiders PDF produserer document.json pluss ett referert PNG-bilde i en ZIP-fil.
Velg PDF-sidene
Last opp PDF-en og la Sider stå tom for hele dokumentet, eller skriv inn delmengden du trenger. Vårt eksempel inkluderer alle fire sider.
Eksporter og hold filene samlet
Velg Start. En eksport med bildemateriale lastes ned som ZIP. Pakk ut hele arkivet og behold images-mappen ved siden av document.json.
Eksemplet inkluderer images/page-001-image-005.png. Bildereferanser peker til filbaner i stedet for å bygge inn binærdata i JSON-filen. En eksport uten bildemateriale kan lastes ned direkte som .json.
Les dokumentstrukturen
Eksemplet deklarerer versjon 1, enheter pt og et øverst-til-venstre-origo. Sideoppføringer inkluderer kildesidenummer, dimensjoner, rotasjon, blokker og tegninger. Koordinater beskriver den uroterte siden; ta hensyn til rotasjon når du legger dataene over.
Analyser JSON-filen med en JSON-parser. Inspiser blokker, linjer og spenn for tekst og formatering, samt bbox-verdier for geometri. Nestede objekter beskriver layout fremfor en enkel tekststreng.
Sjekk leserekkefølge og bildereferanser mot den originale PDF-en før du bruker dataene i din prosesseringsarbeidsflyt.
Vanlige spørsmål
Kan jeg gjenoppbygge den originale PDF-en nøyaktig?
Ikke anta nøyaktig rekonstruksjon. Eksporten beskriver tilgjengelig innhold og geometri, mens PDF-funksjoner og semantikk kan være mer komplekse.
Hvorfor mottok jeg en ZIP-fil?
Eksemplet inneholder et bilde. ZIP-filen holder document.json og den refererte filen samlet slik at bildet kan finnes.
Prøv det med ditt dokument
Gjennomgå resultatet, og lagre deretter versjonen du trenger.

