Avaa PDF to XML viedäksesi sivutietueet, tekstilohkot ja piirrostiedot. Nelisivuinen PDF-tiedostomme tuottaa document.xml-tiedoston sekä yhden viitatun PNG-kuvan ZIP-arkistossa.
Valitse PDF-sivut
Lataa PDF ja jätä Pages-kenttä tyhjäksi koko asiakirjaa varten tai syötä tarvitsemasi sivualue. Esimerkkimme sisältää kaikki neljä sivua.
Vie ja pidä resurssit yhdessä
Valitse Start. Kuvaresursseja sisältävä vienti ladataan ZIP-tiedostona. Pura koko arkisto ja pidä images-hakemisto document.xml-tiedoston vieressä.
Esimerkki sisältää images/page-001-image-005.png. Kuviin viitataan resurssipoluilla sen sijaan, että binääridata upotettaisiin XML-tiedostoon. Vienti ilman kuvaresursseja voidaan ladata suoraan .xml-muodossa.
Lue asiakirjan rakenne
Esimerkki ilmoittaa version 1, yksiköt pt ja top-left-origon. Sivutietueet sisältävät lähdesivun numeron, mitat, kierron, lohkot ja piirrokset. Koordinaatit kuvaavat kiertämätöntä sivua; huomioi kierto, kun asetat tietoja päällekkäin.
Jäsennä XML XML-jäsenninohjelmalla. Toistuvat arvot käyttävät item-elementtejä; jotkin geometriset monikot ovat tekstiarvoja. Tarkista todellinen rakenne sen sijaan, että olettaisit käytössä olevan julkaisuskeeman, kuten DocBook.
Tarkista lukujärjestys ja kuviin viittaaminen alkuperäisestä PDF-tiedostosta ennen tietojen käyttöä käsittelytyönkulussasi.
Yleisiä kysymyksiä
Sisältääkö XML semanttisia lukuja?
Se kuvaa purettua sivutietoa. Otsikoiden merkitys, lukujärjestys ja asiakirjan semantiikka saattavat vaatia omaa tulkintaasi.
Miksi sain ZIP-tiedoston?
Esimerkki sisältää kuvan. ZIP pitää document.xml-tiedoston ja viitatun resurssin yhdessä, jotta kuva löytyy.
Kokeile sitä asiakirjallasi
Tarkista tulos ja tallenna sitten tarvitsemasi versio.

