PDF to Text খুলুন, পৃষ্ঠাগুলো বেছে নিন এবং একটি ডাউনলোড ফরম্যাট নির্বাচন করুন। আমাদের চার পৃষ্ঠার নমুনাটি একটি UTF-8 TXT ফাইল তৈরি করে যাতে এক্সট্র্যাক্ট করা পৃষ্ঠার টেক্সট থাকে।
ব্যবহারযোগ্য টেক্সটসহ একটি PDF লোড করুন
মূল PDF ফাইলটি বেছে নিন। চেক করে দেখুন এর টেক্সট কোনো ভিউয়ারে সিলেক্ট করা যাচ্ছে কি না। শুধুমাত্র পিক্সেল দিয়ে তৈরি স্ক্যান করা পৃষ্ঠার ক্ষেত্রে কার্যকর টেক্সট পাওয়ার জন্য PDF OCR প্রয়োজন।
পৃষ্ঠা এবং প্যাকেজিং সেট করুন
পুরো ডকুমেন্টের জন্য Pages খালি রাখুন, অথবা কোনো নির্দিষ্ট অংশের জন্য রেঞ্জ লিখুন। প্রিভিউতে দেখানো পৃষ্ঠাটি এক্সপোর্টের পরিধি নয়।
উদাহরণস্বরূপ একটি সম্মিলিত TXT-এর জন্য One text file বেছে নিন, অথবা পৃষ্ঠা-ভিত্তিক টেক্সট ফাইল এবং একটি সম্মিলিত ফাইলসহ ZIP-এর জন্য Separate files বেছে নিন।
টেক্সট এক্সট্র্যাক্ট করুন এবং পর্যালোচনা করুন
Start বেছে নিন এবং ডাউনলোড করুন। নমুনাটি 3,940 বাইট তৈরি করে, যেখানে চারটি পৃষ্ঠার সেকশন পেজ-ব্রেক ক্যারেক্টার দ্বারা আলাদা করা থাকে।
একটি টেক্সট এডিটরে TXT ফাইলটি খুলুন এবং কলাম, ক্যাপশন ও টেবিলগুলো চেক করুন। এক্সট্রাকশনের সময় অস্বাভাবিক PDF স্পেসিং থেকে যেতে পারে; টেক্সটটি গন্তব্যে পেস্ট করার আগে তা পরিষ্কার করে নিন।
সাধারণ প্রশ্নাবলী
আমার স্ক্যান করা ফাইলের ফলাফল কেন খালি দেখাচ্ছে?
পৃষ্ঠাটিতে কেবল ছবি থাকতে পারে। শব্দগুলো শনাক্ত করতে PDF OCR ব্যবহার করুন; এই টুলটি বিদ্যমান টেক্সট লেয়ার এক্সট্র্যাক্ট করে।
শিরোনাম এবং নোটের জন্য কোন টুলটি ভালো?
যখন প্লেইন TXT-এর চেয়ে হেডিং মার্কার এবং প্যারাগ্রাফ বেশি দরকারি হয়, তখন PDF to Markdown ব্যবহার করে দেখুন। এর ইনফার্ড স্ট্রাকচারটিও যাচাই করে নিন।
আপনার ডকুমেন্টের সাথে এটি চেষ্টা করে দেখুন
ফলাফলটি পর্যালোচনা করুন, তারপর আপনার প্রয়োজনীয় ভার্সনটি সেভ করুন।

