Öppna PDF till JSON för att exportera sidposter, textblock och ritdata. Vår fyrsidiga PDF skapar document.json plus en refererad PNG-bild inuti ZIP-filen.
Välj PDF-sidorna
Ladda PDF-filen och lämna Sidor tomt för hela dokumentet, eller ange det delmängd du behöver. Vårt exempel inkluderar alla fyra sidor.
Exportera och håll tillgångarna samlade
Välj Start. En export med bildtillgångar laddas ner som ZIP. Extrahera hela arkivet och behåll images-katalogen bredvid document.json.
Exemplet inkluderar images/page-001-image-005.png. Bildreferenser pekar på tillgångssökvägar istället för att bädda in binär data i JSON. En export utan bildtillgångar kan laddas ner direkt som .json.
Läs dokumentstrukturen
Exemplet deklarerar version 1, enheter pt och ett top-left-origo. Sidposter inkluderar källsidnummer, mått, rotation, block och ritningar. Koordinater beskriver den oroterade sidan; ta hänsyn till rotation när du lägger över datan.
Tolka JSON med en JSON-parser. Inspektera block, rader och spann för text och formatering, samt bbox-värden för geometri. Nästlade objekt beskriver layout snarare än en enskild textsträng.
Kontrollera läsordning och bildreferenser mot den ursprungliga PDF-filen innan du använder datan i ditt bearbetningsarbetsflöde.
Vanliga frågor
Kan jag återskapa den ursprungliga PDF-filen exakt?
Anta inte exakt rekonstruktion. Exporten beskriver tillgängligt innehåll och geometri, medan PDF-funktioner och semantik kan vara mer komplexa.
Varför fick jag en ZIP-fil?
Exemplet innehåller en bild. ZIP håller document.json och den refererade tillgången samlade så att bilden kan hittas.
Prova med ditt dokument
Granska resultatet och spara sedan den version du behöver.

