Інструменти150

ПРАКТИЧНИЙ ПОСІБНИК З PDF

Як витягти текст зі сканованого PDF за допомогою OCR

Витягніть слова, а потім відредагуйте їх.

Розпізнайте одну сторінку сканованого PDF або виділену область, виправте текст за допомогою Smart edit і завантажте TXT або Word.

Оновлено

Дотримуйтесь інструкцій
ПРИКЛАД РЕАЛЬНОГО ІНСТРУМЕНТУ
ДоПерша сторінка чотиристорінкового скану без тексту, який можна виділити.
  • 4 сторінок PDF лише із зображеннями
  • Вибрано сторінку 1
ПісляФактичний текст, завантажений зі сторінки 1 за допомогою рушія Future.
  • Редагований TXT для сторінки 1
  • Рушій Future · Англійська
Скан містить пікселі зображення; OCR створює редаговані слова. Цей приклад обробляє лише сторінку 1, а не весь документ.
Advertisements
ШВИДКИЙ ВІДЕОУРОК Як витягти текст зі сканованого PDF за допомогою OCR Витягніть слова, а потім відредагуйте їх. Англійська озвучка Дивитися відео

Як витягти текст зі сканованого PDF за допомогою OCR

Advertisements

Використовуйте PDF OCR для розпізнавання слів із зображень сторінок. Наш приклад починається з чотиристорінкового скану, що складається лише із зображень, і розпізнає його першу сторінку, Overview, у редагований текст.

01

Виберіть сторінку або область

Завантажте PDF і перейдіть до потрібної сторінки. Використовуйте всю сторінку або налаштуйте прямокутник виділення навколо потрібного тексту. У прикладі використовується вся сторінка 1.

Для іншої сторінки або області потрібна окрема дія розпізнавання. Інструмент не обробляє автоматично кожну сторінку завантаженого PDF.

02

Виберіть мову, рушій і формат

Виберіть мову, надруковану на сторінці. Для нашого англійського зразка залиште Future як рушій OCR і виберіть Editable text (.txt).

Виберіть Classic, коли вам потрібен PDF із можливістю пошуку, який зберігає вихідне зображення з невидимим шаром розпізнаного тексту. Future надає редагований текст, Word і переформатований PDF лише з текстом.

03

Розпізнайте, виправте та завантажте

Виберіть Start і завершіть відображену перевірку за допомогою прапорця. Порівняйте розпізнаний результат із вихідним зображенням. Наше завантаження правильно включає Overview, Plan the session і Define the outcome.

Виправте імена, цифри та сумнівні слова перед копіюванням або завантаженням тексту. Виправлення оновлюють редаговані експорти; позиціонований PDF із можливістю пошуку в Classic зберігає початкове розпізнавання, тому перевіряйте цей файл окремо.

04

Удоскональте розпізнаний текст за допомогою Smart edit

Для результату у форматі TXT або Word виберіть Smart edit поруч із Copy. Виділіть уривок для роботи з цим текстом або залиште все без виділення, щоб використовувати весь чернетковий варіант. Виберіть Summarize text, Paraphrase text, Fix grammar або Suggest a title, а потім виберіть Apply. Дія з заголовком додає заголовок над текстом.

Перевіряйте кожну зміну ШІ за допомогою скану, особливо імена, цифри та пропущені слова. Пропозиція залишається в Smart edit, доки ви не виберете Apply Changes. Завантаження TXT і Word потім використовують відредагований звичайний текст. Formatted copy завантажує окремий HTML-файл зі стилями редактора; вихідний скан і текстовий шар PDF із можливістю пошуку в Classic не змінюються.

КІЛЬКА КОРИСНИХ ДЕТАЛЕЙ

Поширені запитання

Чи можу я розпізнати лише один абзац?

Так. Виділіть прямокутник навколо нього перед початком. Перевірте краї, щоб сусідній текст був виключений, а важливі слова не були обрізані.

Чи збереже Future оригінальний дизайн сторінки у своєму PDF?

Його PDF — це переформатований документ лише з текстом. Вибирайте PDF із можливістю пошуку в Classic, якщо метою є збереження зображення сканованої сторінки з текстовим шаром.

Чи може Smart edit змінити PDF із можливістю пошуку?

Ні. Smart edit доступний для результатів у форматі TXT і Word. Apply Changes оновлює редагований текст; він не переписує скановану сторінку або раніше створений PDF із можливістю пошуку.

ВАША ЧЕРГА

Спробуйте зі своїм документом

Перегляньте результат, а потім збережіть потрібну версію.

Відкрити PDF OCR

Деталі зображення

Advertisements

Мову38

English العربية Français Italiano Deutsch Español Português Nederlands Русский Türkçe 日本語 中文 हिन्दी Bahasa Indonesia Bahasa Melayu 한국어 Tiếng Việt ไทย Polski Svenska Українська Norsk বাংলা Ελληνικά فارسی اردو Čeština Dansk Magyar Română Suomi Български Filipino ქართული Slovenčina Azərbaycanca עברית Slovenščina