Buka PDF kepada Teks, pilih halaman dan pilih format muat turun. Contoh empat halaman kami menghasilkan satu fail TXT UTF-8 yang mengandungi teks halaman yang diekstrak.
Muat PDF dengan teks yang boleh digunakan
Pilih PDF asal. Semak sama ada teksnya boleh dipilih dalam pemapar. Halaman imbasan yang hanya terdiri daripada piksel memerlukan PDF OCR sebelum ia boleh memberikan teks yang berguna.
Tetapkan halaman dan pembungkusan
Biarkan Halaman kosong untuk keseluruhan dokumen, atau masukkan julat untuk subset. Halaman yang ditunjukkan dalam pratonton bukanlah skop eksport.
Pilih Satu fail teks untuk TXT gabungan, seperti dalam contoh, atau Fail berasingan untuk ZIP yang mengandungi fail teks peringkat halaman dan fail gabungan.
Ekstrak dan semak teks
Pilih Mula dan muat turun. Contoh ini menghasilkan 3,940 bait, dengan empat bahagian halaman dipisahkan oleh aksara pemisah halaman.
Buka TXT dalam editor teks dan semak lajur, kapsyen dan jadual. Pengekstrakan boleh mengekalkan jarak PDF yang luar biasa; bersihkan ia sebelum menampal teks ke destinasi akhirnya.
Soalan lazim
Mengapa hasilnya kosong untuk imbasan saya?
Halaman mungkin hanya mengandungi imej. Gunakan PDF OCR untuk mengecam perkataannya; alat ini mengekstrak lapisan teks sedia ada.
Alat mana yang lebih baik untuk tajuk dan nota?
Cuba PDF kepada Markdown apabila penanda tajuk dan perenggan lebih berguna daripada TXT biasa. Semak juga struktur yang disimpulkannya.
Cuba dengan dokumen anda
Semak hasil, kemudian simpan versi yang anda perlukan.

