Narzędzia150

PRAKTYCZNY PRZEWODNIK PDF

Jak wyodrębnić tekst ze skanowanego pliku PDF za pomocą OCR

Wyodrębnij słowa, a następnie je dopracuj.

Rozpoznaj jedną stronę skanowanego pliku PDF lub wybrany obszar, popraw tekst za pomocą Smart edit i pobierz plik TXT lub Word.

Zaktualizowano

Postępuj zgodnie z przewodnikiem
PRZYKŁAD RZECZYWISTEGO NARZĘDZIA
PrzedPierwsza strona czterostronicowego skanu bez możliwości zaznaczania tekstu.
  • 4 stron PDF zawierających tylko obrazy
  • Wybrano stronę 1
PoRzeczywisty tekst pobrany ze strony 1 przy użyciu silnika Future.
  • Edytowalny plik TXT dla strony 1
  • Silnik Future · Angielski
Skan zawiera piksele obrazu; OCR tworzy edytowalne słowa. Ten przykład przetwarza tylko stronę 1, a nie cały dokument.
Advertisements
SZYBKI SAMOUCZEK WIDEO Jak wyodrębnić tekst ze skanowanego pliku PDF za pomocą OCR Wyodrębnij słowa, a następnie je dopracuj. Narracja w języku angielskim Obejrzyj wideo

Jak wyodrębnić tekst ze skanowanego pliku PDF za pomocą OCR

Advertisements

Użyj PDF OCR, aby rozpoznać słowa z obrazów stron. Nasz przykład zaczyna się od czterostronicowego skanu zawierającego tylko obrazy i rozpoznaje jego pierwszą stronę, Overview, na edytowalny tekst.

01

Wybierz stronę lub obszar

Załaduj plik PDF i przejdź do potrzebnej strony. Użyj całej strony lub dostosuj prostokąt zaznaczenia wokół potrzebnego tekstu. Przykład wykorzystuje całą stronę 1.

Inna strona lub obszar wymaga oddzielnej operacji rozpoznawania. Narzędzie nie przetwarza automatycznie każdej strony przesłanego pliku PDF.

02

Wybierz język, silnik i format

Wybierz język wydrukowany na stronie. Dla naszej angielskiej próbki zachowaj Future jako silnik OCR i wybierz Editable text (.txt).

Wybierz Classic, gdy potrzebujesz przeszukiwalnego pliku PDF, który zachowuje obraz źródłowy z niewidoczną warstwą rozpoznanego tekstu. Future zapewnia edytowalny tekst, plik Word oraz plik PDF z płynnym tekstem.

03

Rozpoznaj, popraw i pobierz

Wybierz Start i wypełnij wyświetlone pole wyboru weryfikacji. Porównaj rozpoznany wynik z obrazem źródłowym. Nasze pobieranie poprawnie zawiera Overview, Plan the session oraz Define the outcome.

Popraw nazwiska, liczby i niepewne słowa przed skopiowaniem lub pobraniem tekstu. Korekty aktualizują edytowalne eksporty; pozycjonowany przeszukiwalny plik PDF w trybie Classic zachowuje oryginalne rozpoznanie, więc przejrzyj ten plik osobno.

04

Dopracuj rozpoznany tekst za pomocą Smart edit

Aby uzyskać wynik w formacie TXT lub Word, wybierz Smart edit obok Copy. Zaznacz fragment, aby pracować nad tym tekstem, lub pozostaw zaznaczenie puste, aby użyć całego szkicu. Wybierz Summarize text, Paraphrase text, Fix grammar lub Suggest a title, a następnie wybierz Apply. Akcja tytułu dodaje nagłówek nad tekstem.

Sprawdź każdą zmianę AI względem skanu, zwłaszcza nazwiska, liczby i brakujące słowa. Sugestia pozostaje w Smart edit, dopóki nie wybierzesz Apply Changes. Pobrane pliki TXT i Word używają wtedy edytowanego zwykłego tekstu. Formatted copy pobiera oddzielny plik HTML ze stylizacją edytora; oryginalny skan i warstwa tekstowa przeszukiwalnego pliku PDF Classic nie ulegają zmianie.

KILKA PRZYDATNYCH SZCZEGÓŁÓW

Często zadawane pytania

Czy mogę rozpoznać tylko jeden akapit?

Tak. Zaznacz prostokąt wokół niego przed rozpoczęciem. Sprawdź krawędzie, aby pobliski tekst został wykluczony, a ważne słowa nie zostały ucięte.

Czy Future zachowa oryginalny układ strony w swoim pliku PDF?

Jego plik PDF to dokument z płynnym tekstem. Wybierz przeszukiwalny plik PDF w trybie Classic, gdy celem jest zachowanie obrazu skanowanej strony z warstwą tekstową.

Czy Smart edit może zmienić przeszukiwalny plik PDF?

Nie. Smart edit jest dostępny dla wyników TXT i Word. Apply Changes aktualizuje edytowalny tekst; nie nadpisuje skanowanej strony ani wcześniej wygenerowanego przeszukiwalnego pliku PDF.

TWOJA KOLEJ

Wypróbuj to ze swoim dokumentem

Przejrzyj wynik, a następnie zapisz potrzebną wersję.

Otwórz PDF OCR

Szczegóły obrazu

Advertisements

Język38

English العربية Français Italiano Deutsch Español Português Nederlands Русский Türkçe 日本語 中文 हिन्दी Bahasa Indonesia Bahasa Melayu 한국어 Tiếng Việt ไทย Polski Svenska Українська Norsk বাংলা Ελληνικά فارسی اردو Čeština Dansk Magyar Română Suomi Български Filipino ქართული Slovenčina Azərbaycanca עברית Slovenščina