Otwórz PDF do tekstu, wybierz strony i wybierz format pobierania. Nasz czterostronicowy przykład tworzy jeden plik TXT w formacie UTF-8 zawierający wyodrębniony tekst strony.
Wczytaj plik PDF z użytecznym tekstem
Wybierz oryginalny plik PDF. Sprawdź, czy jego tekst można zaznaczyć w przeglądarce. Zeskanowana strona składająca się tylko z pikseli wymaga PDF OCR, zanim będzie mogła dostarczyć użyteczny tekst.
Ustaw strony i pakowanie
Pozostaw Strony puste dla całego dokumentu lub wprowadź zakres dla podzbioru. Strona pokazana w podglądzie nie określa zakresu eksportu.
Wybierz Jeden plik tekstowy dla połączonego pliku TXT, jak w przykładzie, lub Oddzielne pliki dla pliku ZIP zawierającego pliki tekstowe poszczególnych stron oraz plik zbiorczy.
Wyodrębnij i przejrzyj tekst
Wybierz Start i pobierz. Przykład generuje 3,940 bajtów, z czterema sekcjami stron oddzielonymi znakami podziału strony.
Otwórz plik TXT w edytorze tekstu i sprawdź kolumny, podpisy oraz tabele. Ekstrakcja może zachować nietypowe odstępy z pliku PDF; wyczyść je przed wklejeniem tekstu do miejsca docelowego.
Często zadawane pytania
Dlaczego wynik jest pusty dla mojego skanu?
Strona może zawierać tylko obraz. Użyj PDF OCR, aby rozpoznać słowa; to narzędzie wyodrębnia istniejącą warstwę tekstową.
Które narzędzie jest lepsze do nagłówków i notatek?
Wypróbuj PDF do Markdown, gdy znaczniki nagłówków i akapity są bardziej przydatne niż zwykły TXT. Przejrzyj również jego wywnioskowaną strukturę.
Wypróbuj to ze swoim dokumentem
Przejrzyj wynik, a następnie zapisz wersję, której potrzebujesz.

