Инструменты150

ПРАКТИЧЕСКОЕ РУКОВОДСТВО ПО PDF

Как преобразовать PDF в редактируемый текст

Извлеките слова из текстового PDF-файла.

Извлеките существующий текст из PDF в один TXT-файл или отдельные файлы для каждой страницы. Выберите страницы и проверьте порядок чтения перед повторным использованием текста.

Перейти к инструкции
ПРИМЕР РАБОТЫ ИНСТРУМЕНТА
ДоПервая страница четырехстраничного исходного PDF-файла.
  • 4 страницы PDF
ПослеФрагмент первой страницы из фактически скачанного объединенного TXT-файла.
  • 1 TXT-файл · 3940 байт
  • Показан фрагмент первой страницы
Дизайн PDF превращается в обычный текст. Показана только первая страница; скачанный TXT-файл содержит все четыре выбранные страницы.
Advertisements
КРАТКИЙ ВИДЕОУРОК Как преобразовать PDF в редактируемый текст Извлеките слова из текстового PDF-файла. Английская озвучка Смотреть видео

Как преобразовать PDF в редактируемый текст

Advertisements

Откройте PDF в текст, выберите страницы и формат загрузки. Наш четырехстраничный пример создает один TXT-файл в кодировке UTF-8, содержащий извлеченный текст страниц.

01

Загрузите PDF с доступным текстом

Выберите исходный PDF. Проверьте, можно ли выделить в нем текст с помощью программы просмотра. Отсканированная страница, состоящая только из пикселей, требует PDF OCR, прежде чем из нее можно будет получить полезный текст.

02

Установите страницы и упаковку

Оставьте поле Страницы пустым для всего документа или введите диапазон для части страниц. Страница, отображаемая в предварительном просмотре, не определяет область экспорта.

Выберите Один текстовый файл для объединенного TXT, как в примере, или Отдельные файлы для ZIP-архива, содержащего текстовые файлы для каждой страницы и объединенный файл.

03

Извлеките и проверьте текст

Нажмите Начать и скачайте результат. Пример весит 3940 байт, а четыре раздела страниц разделены символами разрыва страницы.

Откройте TXT в текстовом редакторе и проверьте столбцы, подписи и таблицы. При извлечении могут сохраняться необычные интервалы из PDF; приведите их в порядок перед вставкой текста в целевой документ.

НЕСКОЛЬКО ПОЛЕЗНЫХ ДЕТАЛЕЙ

Часто задаваемые вопросы

Почему результат пуст для моего скана?

Страница может содержать только изображение. Используйте PDF OCR для распознавания слов; этот инструмент извлекает существующий текстовый слой.

Какой инструмент лучше подходит для заголовков и заметок?

Попробуйте PDF в Markdown, если маркеры заголовков и абзацы полезнее, чем обычный TXT. Также проверьте распознанную структуру.

ВАША ОЧЕРЕДЬ

Попробуйте на своем документе

Проверьте результат, затем сохраните нужную версию.

Открыть PDF в текст

Детали изображения

Advertisements

Язык38

English العربية Français Italiano Deutsch Español Português Nederlands Русский Türkçe 日本語 中文 हिन्दी Bahasa Indonesia Bahasa Melayu 한국어 Tiếng Việt ไทย Polski Svenska Українська Norsk বাংলা Ελληνικά فارسی اردو Čeština Dansk Magyar Română Suomi Български Filipino ქართული Slovenčina Azərbaycanca עברית Slovenščina