Otevřete PDF do JSON pro export záznamů stránek, textových bloků a dat o kresbách. Naše čtyřstránkové PDF vytvoří document.json a jeden odkazovaný obrázek PNG uvnitř ZIP archivu.
Vyberte stránky PDF
Nahrajte PDF a nechte Stránky prázdné pro celý dokument, nebo zadejte podmnožinu, kterou potřebujete. Náš příklad obsahuje všechny čtyři stránky.
Exportujte a udržujte soubory pohromadě
Zvolte Start. Export s obrázky se stáhne jako ZIP. Rozbalte celý archiv a ponechte adresář images vedle souboru document.json.
Ukázka obsahuje images/page-001-image-005.png. Odkazy na obrázky směřují na cesty k souborům namísto vkládání binárních dat přímo do JSON. Export bez obrázků lze stáhnout přímo jako .json.
Přečtěte strukturu dokumentu
Ukázka deklaruje verzi 1, jednotky pt a počátek vlevo nahoře. Záznamy stránek obsahují číslo zdrojové stránky, rozměry, rotaci, bloky a kresby. Souřadnice popisují neotočenou stránku; při překrývání dat zohledněte rotaci.
Analyzujte JSON pomocí parseru. Zkontrolujte bloky, řádky a úseky pro text a stylování, a hodnoty bbox pro geometrii. Vnořené objekty popisují rozvržení namísto jediného textového řetězce.
Před použitím dat ve svém pracovním postupu zkontrolujte pořadí čtení a odkazy na obrázky oproti původnímu PDF.
Časté dotazy
Mohu přesně obnovit původní PDF?
Nepředpokládejte přesnou rekonstrukci zpětným převodem. Export popisuje dostupné obsahy a geometrii, zatímco funkce a sémantika PDF mohou být složitější.
Proč jsem obdržel ZIP?
Ukázka obsahuje obrázek. ZIP udržuje document.json a odkazovaný soubor pohromadě, aby bylo možné obrázek najít.
Vyzkoušejte to se svým dokumentem
Zkontrolujte výsledek a poté uložte verzi, kterou potřebujete.

