Отворете PDF към текст, изберете страниците и изберете формат за изтегляне. Нашият примерен файл от четири страници генерира един UTF-8 TXT файл, съдържащ извлечения текст от страниците.
Заредете PDF с използваем текст
Изберете оригиналния PDF файл. Проверете дали текстът му може да бъде селектиран в програма за преглед. Сканирана страница, състояща се само от пиксели, се нуждае от PDF OCR, преди да може да предостави полезен текст.
Задайте страниците и пакетирането
Оставете Страници празно за целия документ или въведете диапазон за част от него. Страницата, показана в прегледа, не определя обхвата на експортиране.
Изберете Един текстов файл за комбиниран TXT, както е в примера, или Отделни файлове за ZIP архив, съдържащ текстови файлове за всяка страница и комбиниран файл.
Извлечете и прегледайте текста
Изберете Старт и изтеглете. Примерът генерира 3,940 байта, като четирите секции на страниците са разделени със символи за прекъсване на страница.
Отворете TXT файла в текстов редактор и проверете колоните, надписите и таблиците. Извличането може да запази необичайни разстояния от PDF файла; почистете ги, преди да поставите текста в крайното му местоположение.
Често задавани въпроси
Защо резултатът е празен за моето сканиране?
Страницата може да съдържа само изображение. Използвайте PDF OCR, за да разпознаете думите в него; този инструмент извлича съществуващ текстов слой.
Кой инструмент е по-добър за заглавия и бележки?
Опитайте PDF към Markdown, когато маркерите за заглавия и параграфи са по-полезни от обикновен TXT. Прегледайте и неговата структура.
Опитайте с вашия документ
Прегледайте резултата, след което запишете версията, от която се нуждаете.

