Orodja150

PRAKTIČNI VODNIK ZA PDF

Kako pretvoriti PDF v XML s podatki o postavitvi

Pridobite strukturirane podatke o straneh za svoj potek dela.

Izvozite besedilo PDF, dimenzije strani in podatke o risanju v obliki XML. Ohranite referenčne slike skupaj in preverite strukturo, preden jo uporabite v kodi.

Sledi vodiču
PRIMER PRAVEGA ORODJA
PredPrva stran štiristranskega vira PDF.
  • 4 strani PDF
PoLepopisno oblikovan začetni izsek dejanskega izvoza document.xml.
  • document.xml · 4 zapisov strani
  • 1 referenčna datoteka PNG
Rezultat so strukturirani podatki XML, prikazani kot izsek. Celoten izvoz vključuje vse štiri strani in referenčno slikovno datoteko.
Advertisements
HITRA VIDEO VADNICA Kako pretvoriti PDF v XML s podatki o postavitvi Pridobite strukturirane podatke o straneh za svoj potek dela. Angleška pripoved Oglejte si video

Kako pretvoriti PDF v XML s podatki o postavitvi

Advertisements

Odprite PDF v XML za izvoz zapisov strani, besedilnih blokov in podatkov o risanju. Naš štiristranski PDF ustvari document.xml in eno referenčno sliko PNG znotraj datoteke ZIP.

01

Izberite strani PDF

Naložite PDF in pustite Strani prazne za celoten dokument ali vnesite podmnožico, ki jo potrebujete. Naš primer vključuje vse štiri strani.

02

Izvozite in ohranite datoteke skupaj

Izberite Začni. Izvoz s slikovnimi datotekami se prenese kot ZIP. Izvlecite celoten arhiv in ohranite imenik images poleg document.xml.

Vzorec vključuje images/page-001-image-005.png. Slikovne reference kažejo na poti do datotek namesto vdelave binarnih podatkov v XML. Izvoz brez slikovnih datotek se lahko prenese neposredno kot .xml.

03

Preberite strukturo dokumenta

Vzorec deklarira različico 1, enote pt in izhodišče zgoraj-levo. Zapisi strani vključujejo številko izvorne strani, dimenzije, rotacijo, bloke in risbe. Koordinate opisujejo nerotirano stran; pri prekrivanju podatkov upoštevajte rotacijo.

Razčlenite XML s razčlenjevalnikom XML. Ponavljajoče se vrednosti uporabljajo elemente item; nekatere geometrijske n-terice so besedilne vrednosti. Preglejte dejansko strukturo namesto predvidevanja sheme objavljanja, kot je DocBook.

Pred uporabo podatkov v svojem poteku dela preverite vrstni red branja in slikovne reference glede na izvirni PDF.

NEKAJ UPORABNIH PODROBNOSTI

Pogosta vprašanja

Ali XML vsebuje semantična poglavja?

Opisuje ekstrahirane podatke strani. Pomen naslovov, vrstni red branja in semantika dokumenta morda potrebujejo vašo lastno interpretacijo.

Zakaj sem prejel ZIP?

Vzorec vsebuje sliko. ZIP ohranja document.xml in referenčno datoteko skupaj, tako da je sliko mogoče najti.

STE NA VRSTI

Poskusite s svojim dokumentom

Preglejte rezultat in nato shranite različico, ki jo potrebujete.

Odprite PDF v XML

Podrobnosti slike

Advertisements

Jezik38

English العربية Français Italiano Deutsch Español Português Nederlands Русский Türkçe 日本語 中文 हिन्दी Bahasa Indonesia Bahasa Melayu 한국어 Tiếng Việt ไทย Polski Svenska Українська Norsk বাংলা Ελληνικά فارسی اردو Čeština Dansk Magyar Română Suomi Български Filipino ქართული Slovenčina Azərbaycanca עברית Slovenščina