Откройте PDF в текст, выберите страницы и формат загрузки. Наш четырехстраничный пример создает один TXT-файл в кодировке UTF-8, содержащий извлеченный текст страниц.
Загрузите PDF с доступным текстом
Выберите исходный PDF. Проверьте, можно ли выделить в нем текст с помощью программы просмотра. Отсканированная страница, состоящая только из пикселей, требует PDF OCR, прежде чем из нее можно будет получить полезный текст.
Установите страницы и упаковку
Оставьте поле Страницы пустым для всего документа или введите диапазон для части страниц. Страница, отображаемая в предварительном просмотре, не определяет область экспорта.
Выберите Один текстовый файл для объединенного TXT, как в примере, или Отдельные файлы для ZIP-архива, содержащего текстовые файлы для каждой страницы и объединенный файл.
Извлеките и проверьте текст
Нажмите Начать и скачайте результат. Пример весит 3940 байт, а четыре раздела страниц разделены символами разрыва страницы.
Откройте TXT в текстовом редакторе и проверьте столбцы, подписи и таблицы. При извлечении могут сохраняться необычные интервалы из PDF; приведите их в порядок перед вставкой текста в целевой документ.
Часто задаваемые вопросы
Почему результат пуст для моего скана?
Страница может содержать только изображение. Используйте PDF OCR для распознавания слов; этот инструмент извлекает существующий текстовый слой.
Какой инструмент лучше подходит для заголовков и заметок?
Попробуйте PDF в Markdown, если маркеры заголовков и абзацы полезнее, чем обычный TXT. Также проверьте распознанную структуру.
Попробуйте на своем документе
Проверьте результат, затем сохраните нужную версию.

