Åpne PDF til XML for å eksportere sideregistreringer, tekstblokker og tegnedata. Vår firesiders PDF produserer document.xml pluss ett referert PNG-bilde inne i en ZIP-fil.
Velg PDF-sidene
Last opp PDF-en og la Sider stå tom for hele dokumentet, eller skriv inn delmengden du trenger. Vårt eksempel inkluderer alle fire sider.
Eksporter og hold ressursene samlet
Velg Start. En eksport med bildemateriale lastes ned som ZIP. Pakk ut hele arkivet og behold images-mappen ved siden av document.xml.
Eksemplet inkluderer images/page-001-image-005.png. Bildereferanser peker til filbaner i stedet for å bygge inn binærdata i XML-en. En eksport uten bildemateriale kan lastes ned direkte som .xml.
Les dokumentstrukturen
Eksemplet deklarerer versjon 1, enheter pt og et øverst-til-venstre origo. Sideregistreringer inkluderer kildesidenummer, dimensjoner, rotasjon, blokker og tegninger. Koordinater beskriver den uroterte siden; ta hensyn til rotasjon når du legger dataene over.
Analyser XML-en med en XML-parser. Gjentatte verdier bruker elementer; noen geometriske tupler er tekstverdier. Inspiser den faktiske strukturen i stedet for å anta et publiseringsskjema som DocBook.
Sjekk leserekkefølge og bildereferanser mot den originale PDF-en før du bruker dataene i din arbeidsflyt.
Vanlige spørsmål
Inneholder XML-en semantiske kapitler?
Det beskriver uthentede sidedata. Overskriftsbetydning, leserekkefølge og dokumentsemantikk kan kreve din egen tolkning.
Hvorfor mottok jeg en ZIP-fil?
Eksemplet inneholder et bilde. ZIP-filen holder document.xml og den refererte ressursen samlet slik at bildet kan finnes.
Prøv det med ditt dokument
Gjennomgå resultatet, og lagre deretter versjonen du trenger.

