Buksan ang PDF to Text, piliin ang mga pahina, at pumili ng format para sa pag-download. Ang aming sample na may apat na pahina ay gumagawa ng isang UTF-8 TXT file na naglalaman ng na-extract na text ng pahina.
Mag-load ng PDF na may magagamit na text
Piliin ang orihinal na PDF. Suriin kung ang text nito ay maaaring piliin sa isang viewer. Ang isang scanned na pahina na binubuo lamang ng mga pixel ay nangangailangan ng PDF OCR bago ito makapagbigay ng kapaki-pakinabang na text.
Itakda ang mga pahina at packaging
Iwanang blangko ang Pages para sa buong dokumento, o maglagay ng range para sa isang bahagi nito. Ang pahinang ipinapakita sa preview ay hindi ang saklaw ng export.
Piliin ang One text file para sa pinagsamang TXT, gaya ng sa halimbawa, o Separate files para sa isang ZIP na naglalaman ng mga text file bawat pahina at isang pinagsamang file.
I-extract at suriin ang text
Piliin ang Start at i-download. Ang sample ay gumagawa ng 3,940 bytes, na may apat na seksyon ng pahina na pinaghihiwalay ng mga page-break character.
Buksan ang TXT sa isang text editor at suriin ang mga column, caption, at table. Maaaring mapanatili ng extraction ang hindi pangkaraniwang spacing ng PDF; linisin ito bago i-paste ang text sa destinasyon nito.
Mga karaniwang tanong
Bakit walang laman ang resulta para sa aking scan?
Maaaring imahe lamang ang naglalaman ng pahina. Gamitin ang PDF OCR upang kilalanin ang mga salita nito; ang tool na ito ay nag-e-extract ng kasalukuyang text layer.
Aling tool ang mas mahusay para sa mga heading at note?
Subukan ang PDF to Markdown kung ang mga heading marker at talata ay mas kapaki-pakinabang kaysa sa plain TXT. Suriin din ang inferred structure nito.
Subukan ito sa iyong dokumento
Suriin ang resulta, pagkatapos ay i-save ang bersyong kailangan mo.

