Otevřete PDF do textu, vyberte stránky a zvolte formát stahování. Náš čtyřstránkový vzorek vytvoří jeden soubor TXT ve formátu UTF-8 obsahující extrahovaný text stránek.
Načtěte PDF s použitelným textem
Vyberte původní PDF. Zkontrolujte, zda lze jeho text v prohlížeči vybrat. Naskenovaná stránka tvořená pouze pixely vyžaduje PDF OCR, než z ní bude možné získat užitečný text.
Nastavte stránky a balení
Ponechte Stránky prázdné pro celý dokument nebo zadejte rozsah pro jeho část. Stránka zobrazená v náhledu neurčuje rozsah exportu.
Zvolte Jeden textový soubor pro sloučený TXT, jako v příkladu, nebo Samostatné soubory pro ZIP obsahující textové soubory jednotlivých stránek a sloučený soubor.
Extrahujte a zkontrolujte text
Zvolte Start a stáhněte. Vzorek vytvoří 3,940 bajtů se čtyřmi sekcemi stránek oddělenými znaky konce stránky.
Otevřete TXT v textovém editoru a zkontrolujte sloupce, popisky a tabulky. Extrakce může zachovat neobvyklé mezery z PDF; před vložením textu do cílového umístění je vyčistěte.
Časté dotazy
Proč je výsledek pro můj sken prázdný?
Stránka může obsahovat pouze obrázek. Použijte PDF OCR k rozpoznání slov; tento nástroj extrahuje stávající textovou vrstvu.
Který nástroj je lepší pro nadpisy a poznámky?
Zkuste PDF do Markdown, pokud jsou značky nadpisů a odstavce užitečnější než prostý TXT. Zkontrolujte také jeho odvozenou strukturu.
Vyzkoušejte to se svým dokumentem
Zkontrolujte výsledek a poté uložte verzi, kterou potřebujete.

