Verktøy150

EN PRAKTISK PDF-VEILEDNING

Slik konverterer du PDF til XML med layoutdata

Få strukturerte sidedata for din egen arbeidsflyt.

Eksporter PDF-tekst, sideoppløsning og tegnedata som XML. Hold refererte bilder samlet og inspiser strukturen før du bruker den i kode.

Følg guiden
ET EKSEMPEL PÅ ET EKTE VERKTØY
FørFørste side av PDF-kilden på fire sider.
  • 4 PDF-sider
EtterPretty-printet åpningsutdrag av den faktiske document.xml-eksporten.
  • document.xml · 4 sideregistreringer
  • 1 referert PNG-ressurs
Resultatet er strukturerte XML-data, vist som et utdrag. Den fullstendige eksporten inkluderer alle fire sider og den refererte bildefilen.
Advertisements
RASK VIDEOVEILEDNING Slik konverterer du PDF til XML med layoutdata Få strukturerte sidedata for din egen arbeidsflyt. Engelsk fortellerstemme Se videoen

Slik konverterer du PDF til XML med layoutdata

Advertisements

Åpne PDF til XML for å eksportere sideregistreringer, tekstblokker og tegnedata. Vår firesiders PDF produserer document.xml pluss ett referert PNG-bilde inne i en ZIP-fil.

01

Velg PDF-sidene

Last opp PDF-en og la Sider stå tom for hele dokumentet, eller skriv inn delmengden du trenger. Vårt eksempel inkluderer alle fire sider.

02

Eksporter og hold ressursene samlet

Velg Start. En eksport med bildemateriale lastes ned som ZIP. Pakk ut hele arkivet og behold images-mappen ved siden av document.xml.

Eksemplet inkluderer images/page-001-image-005.png. Bildereferanser peker til filbaner i stedet for å bygge inn binærdata i XML-en. En eksport uten bildemateriale kan lastes ned direkte som .xml.

03

Les dokumentstrukturen

Eksemplet deklarerer versjon 1, enheter pt og et øverst-til-venstre origo. Sideregistreringer inkluderer kildesidenummer, dimensjoner, rotasjon, blokker og tegninger. Koordinater beskriver den uroterte siden; ta hensyn til rotasjon når du legger dataene over.

Analyser XML-en med en XML-parser. Gjentatte verdier bruker elementer; noen geometriske tupler er tekstverdier. Inspiser den faktiske strukturen i stedet for å anta et publiseringsskjema som DocBook.

Sjekk leserekkefølge og bildereferanser mot den originale PDF-en før du bruker dataene i din arbeidsflyt.

NOEN NYTTIGE DETALJER

Vanlige spørsmål

Inneholder XML-en semantiske kapitler?

Det beskriver uthentede sidedata. Overskriftsbetydning, leserekkefølge og dokumentsemantikk kan kreve din egen tolkning.

Hvorfor mottok jeg en ZIP-fil?

Eksemplet inneholder et bilde. ZIP-filen holder document.xml og den refererte ressursen samlet slik at bildet kan finnes.

DIN TUR

Prøv det med ditt dokument

Gjennomgå resultatet, og lagre deretter versjonen du trenger.

Åpne PDF til XML

Bildedetalj

Advertisements

Språk38

English العربية Français Italiano Deutsch Español Português Nederlands Русский Türkçe 日本語 中文 हिन्दी Bahasa Indonesia Bahasa Melayu 한국어 Tiếng Việt ไทย Polski Svenska Українська Norsk বাংলা Ελληνικά فارسی اردو Čeština Dansk Magyar Română Suomi Български Filipino ქართული Slovenčina Azərbaycanca עברית Slovenščina