Nyissa meg a PDF-ből szöveggé eszközt, válassza ki az oldalakat, és válasszon letöltési formátumot. A négyoldalas mintánk egyetlen UTF-8 TXT-fájlt hoz létre, amely tartalmazza a kinyert oldalszöveget.
Töltsön be egy használható szöveget tartalmazó PDF-et
Válassza ki az eredeti PDF-et. Ellenőrizze, hogy a szövege kijelölhető-e egy megjelenítőben. A csak képpontokból álló szkennelt oldalhoz PDF OCR szükséges, mielőtt hasznos szöveget adhatna.
Állítsa be az oldalakat és a csomagolást
Hagyja üresen a Oldalak mezőt a teljes dokumentumhoz, vagy adjon meg egy tartományt egy részhalmazhoz. Az előnézetben látható oldal nem az exportálás hatóköre.
Válassza a Egy szövegfájl lehetőséget egy kombinált TXT-hez, mint a példában, vagy a Külön fájlok lehetőséget egy ZIP-hez, amely oldalankénti szövegfájlokat és egy kombinált fájlt tartalmaz.
Kinyerés és a szöveg áttekintése
Válassza a Indítás lehetőséget, majd töltse le. A minta 3,940 bájtot hoz létre, négy oldalszakasszal, amelyeket oldaltörés karakterek választanak el.
Nyissa meg a TXT-t egy szövegszerkesztőben, és ellenőrizze az oszlopokat, feliratokat és táblázatokat. A kinyerés megőrizheti a szokatlan PDF-térközt; tisztítsa meg, mielőtt beillesztené a szöveget a célhelyére.
Gyakori kérdések
Miért üres az eredmény a szkennelésemnél?
Az oldal csak egy képet tartalmazhat. Használja a PDF OCR-t a szavak felismeréséhez; ez az eszköz egy meglévő szövegréteget nyer ki.
Melyik eszköz jobb a címsorokhoz és jegyzetekhez?
Próbálja ki a PDF-ből Markdownba eszközt, ha a címsorjelölők és bekezdések hasznosabbak, mint az egyszerű TXT. Tekintse át a kikövetkeztetett struktúrát is.
Próbálja ki a dokumentumával
Tekintse át az eredményt, majd mentse el a szükséges verziót.

