Avaa PDF tekstiksi, valitse sivut ja valitse latausmuoto. Nelisivuinen esimerkkimme tuottaa yhden UTF-8 TXT-tiedoston, joka sisältää puretun sivutekstin.
Lataa PDF, jossa on käyttökelpoista tekstiä
Valitse alkuperäinen PDF. Tarkista, voiko sen tekstiä valita katseluohjelmassa. Vain pikseleistä koostuva skannattu sivu tarvitsee PDF OCR-toiminnon ennen kuin se voi tarjota hyödyllistä tekstiä.
Määritä sivut ja paketointi
Jätä Sivut tyhjäksi koko asiakirjaa varten tai syötä sivualue osajoukolle. Esikatselussa näkyvä sivu ei määritä vientialuetta.
Valitse Yksi tekstitiedosto yhdistettyä TXT-tiedostoa varten, kuten esimerkissä, tai Erilliset tiedostot ZIP-tiedostoa varten, joka sisältää sivukohtaiset tekstitiedostot ja yhdistetyn tiedoston.
Pura ja tarkista teksti
Valitse Aloita ja lataa. Esimerkki tuottaa 3,940 tavua, ja neljä sivuosiota on erotettu sivunvaihtomerkeillä.
Avaa TXT-tiedosto tekstieditorissa ja tarkista sarakkeet, kuvatekstit ja taulukot. Purku voi säilyttää epätavallisen PDF-välistyksen; siisti se ennen tekstin liittämistä kohteeseensa.
Usein kysytyt kysymykset
Miksi tulos on tyhjä skannaukselleni?
Sivu voi sisältää vain kuvan. Käytä PDF OCR -toimintoa sanojen tunnistamiseen; tämä työkalu purkaa olemassa olevan tekstikerroksen.
Mikä työkalu on parempi otsikoille ja muistiinpanoille?
Kokeile PDF Markdowniksi -toimintoa, kun otsikkomerkit ja kappaleet ovat hyödyllisempiä kuin pelkkä TXT. Tarkista myös sen päättelemä rakenne.
Kokeile sitä asiakirjallasi
Tarkista tulos ja tallenna tarvitsemasi versio.

