Værktøjer150

EN PRAKTISK PDF-GUIDE

Sådan konverterer du PDF til XML med layoutdata

Få strukturerede sidedata til din egen arbejdsgang.

Eksportér PDF-tekst, sidetimensioner og tegnedata som XML. Hold refererede billeder samlet og inspicér strukturen, før du bruger den i din kode.

Følg guiden
ET EKSEMPEL PÅ ET RIGTIGT VÆRKTØJ
FørFørste side af PDF-kilden på fire sider.
  • 4 PDF-sider
EfterPretty-printet åbningsuddrag af den faktiske document.xml-eksport.
  • document.xml · 4 sideposter
  • 1 refereret PNG-aktiv
Resultatet er strukturerede XML-data, vist som et uddrag. Den fulde eksport inkluderer alle fire sider og det refererede billedaktiv.
Advertisements
HURTIG VIDEO-VEJLEDNING Sådan konverterer du PDF til XML med layoutdata Få strukturerede sidedata til din egen arbejdsgang. Engelsk fortællerstemme Se videoen

Sådan konverterer du PDF til XML med layoutdata

Advertisements

Åbn PDF til XML for at eksportere sideposter, tekstblokke og tegnedata. Vores PDF på fire sider producerer document.xml plus ét refereret PNG-billede inde i en ZIP-fil.

01

Vælg PDF-siderne

Indlæs PDF'en og lad Sider stå tom for hele dokumentet, eller indtast det undersæt, du har brug for. Vores eksempel inkluderer alle fire sider.

02

Eksportér og hold aktiverne samlet

Vælg Start. En eksport med billedaktiver downloades som ZIP. Udpak hele arkivet og behold images-mappen ved siden af document.xml.

Eksemplet inkluderer images/page-001-image-005.png. Billedreferencer peger på aktivstier i stedet for at indlejre binære data i XML'en. En eksport uden billedaktiver kan downloades direkte som .xml.

03

Læs dokumentstrukturen

Eksemplet erklærer version 1, enheder pt og en top-venstre oprindelse. Sideposter inkluderer kildesidenummer, dimensioner, rotation, blokke og tegninger. Koordinater beskriver den uroterede side; tag højde for rotation, når du lægger dataene ovenpå.

Parse XML'en med en XML-parser. Gentagne værdier bruger item-elementer; nogle geometriske tupler er tekstværdier. Inspicér den faktiske struktur i stedet for at antage et publiceringsskema som f.eks. DocBook.

Tjek læserækkefølge og billedreferencer mod den originale PDF, før du bruger dataene i din arbejdsgang.

ET PAR NYTTIGE DETALJER

Almindelige spørgsmål

Indeholder XML'en semantiske kapitler?

Det beskriver udtrukne sidedata. Overskriftsbetydning, læserækkefølge og dokumentsemantik kan kræve din egen fortolkning.

Hvorfor modtog jeg en ZIP-fil?

Eksemplet indeholder et billede. ZIP-filen holder document.xml og det refererede aktiv samlet, så billedet kan findes.

DIN TUR

Prøv det med dit dokument

Gennemse resultatet, og gem derefter den version, du har brug for.

Åbn PDF til XML

Billeddetalje

Advertisements

Sprog38

English العربية Français Italiano Deutsch Español Português Nederlands Русский Türkçe 日本語 中文 हिन्दी Bahasa Indonesia Bahasa Melayu 한국어 Tiếng Việt ไทย Polski Svenska Українська Norsk বাংলা Ελληνικά فارسی اردو Čeština Dansk Magyar Română Suomi Български Filipino ქართული Slovenčina Azərbaycanca עברית Slovenščina