ابزارها150

یک کار مفید با PDF، به سادگی انجام شد

استخراج جداول از PDF.

جداول PDF را به جداول قابل ویرایش Word، صفحات گسترده و داده‌های قابل استفاده مجدد تبدیل کنید. جداول را به صورت خودکار تشخیص دهید یا نواحی خود را ترسیم کنید.

Advertisements
فضای کاری PDF شما
پردازش موقت سرور
یا فایل‌های خود را اینجا رها کنید
هنگامی که جداول را تشخیص، پیش‌نمایش یا خروجی می‌گیرید، PDF شما آپلود می‌شود. PDF
Advertisements

چگونه جداول را از pdf استخراج کنیم

  1. 01

    PDF خود را باز کنید

    یک PDF را باز کنید، سپس روی «تشخیص جداول» برای این صفحه یا تمام صفحات کلیک کنید. همچنین می‌توانید نواحی جدول خود را رسم کنید.

  2. 02

    جداول خود را بازبینی کنید

    پیش‌نمایش سلول را بررسی کنید، نواحی را رسم یا تنظیم کنید و جداول مورد نیاز خود را انتخاب کنید.

  3. 03

    یک فرمت انتخاب کنید

    جداول قابل ویرایش Word، یک فایل اکسل یا داده‌های جدول قابل استفاده مجدد را دانلود کنید.

وبلاگنحوه استخراج جداول از PDF به اکسلخواندن راهنما

استخراج جداول از PDF

جداول را به‌طور خودکار در یک PDF قابل انتخاب پیدا کنید، یا یک مستطیل دور هر جدول بکشید. سلول‌های استخراج‌شده را بررسی کنید، جداول مورد نظر برای گنجاندن را انتخاب کنید و سپس به Word، Excel، CSV، TXT، HTML، JSON یا XML صادر کنید.

انتقال مقادیر جدول به خارج از صفحه
آموزش ویدیویی سریع نحوه استخراج جداول از PDF به اکسل جدول را به فرمتی منتقل کنید که بتوانید با آن کار کنید. روایت انگلیسی مشاهده ویدیو

نحوه استخراج جداول از PDF به اکسل

روش‌های کاربردی برای استفاده از این ابزار

امور مالی و عملیاتی

انتقال جداول گزارش به صفحات گسترده

جداول مالی یا عملیاتی را استخراج کنید، سپس مجموع‌ها، جداکننده‌های اعشاری و مرزهای ستون‌ها را تأیید کنید.

پژوهشگران

جمع‌آوری داده‌ها از جداول منتشرشده

فقط جداول مورد نیاز خود را انتخاب کنید و قبل از تحلیل، سلول‌های صادرشده را با PDF منبع مقایسه کنید.

توسعه‌دهندگان

صادرات داده‌های ساختاریافته جدول

پس از بررسی ردیف‌ها و ستون‌های شناسایی‌شده، CSV، JSON یا XML را برای پردازش بعدی انتخاب کنید.

ویژگی‌ها و کنترل‌ها

یافتن جداول یا ترسیم نواحی دلخواه

تشخیص را برای این صفحه یا همه صفحات شروع کنید، یا یک مستطیل جداگانه دور هر جدول بکشید.

انتخاب، تنظیم و پیش‌نمایش نواحی جدول

باز کردن یک PDF آن را برای یافتن جداول اسکن نمی‌کند. گزینه «این صفحه» یا «همه صفحات» را انتخاب کرده و هنگام آمادگی روی «تشخیص جداول» کلیک کنید. تشخیص خودکار ابتدا به دنبال جداول خط‌کشی‌شده می‌گردد و در صفحاتی که جداول خط‌کشی‌شده یافت نمی‌شوند، از تراز متن استفاده می‌کند. یک جدول را انتخاب کنید تا سلول‌های استخراج‌شده آن در زیر PDF بارگذاری شود. برای کنترل خروجی، جداول را تیک بزنید یا تیک آن‌ها را بردارید.

در حالت «ترسیم جداول»، دور هر جدول بکشید. می‌توانید یک کادر موجود را جابه‌جا یا تغییر اندازه دهید، نواحی را در صفحات دیگر اضافه کنید، یک ناحیه را حذف کرده و تغییرات را لغو کنید. کتابخانه سلول‌های داخل هر مستطیل را تشخیص می‌دهد؛ شبکه ثابت و با فاصله یکسان وجود ندارد. برای انتخاب با صفحه‌کلید، روی ناحیه صفحه تمرکز کرده و N را برای افزودن یک منطقه فشار دهید، از کلیدهای جهت‌دار برای جابه‌جایی، Shift و کلیدهای جهت‌دار برای تغییر اندازه، یا Delete برای حذف آن استفاده کنید.

یک فرمت جدول قابل استفاده مجدد انتخاب کنید

Word، Excel، CSV، TXT، HTML، JSON یا XML را دانلود کنید، یا یک جدول را در کلیپ‌بورد کپی کنید.

جداول متعدد، متن فارسی و فرمت‌های خروجی

Word جداول قابل ویرایش ایجاد می‌کند و می‌تواند هر جدول را در یک صفحه جدید قرار دهد. Excel از یک کاربرگ برای هر جدول استفاده می‌کند. CSV، TXT، HTML، JSON و XML می‌توانند جداول انتخاب‌شده را ترکیب کرده یا فایل‌های جداگانه را در یک ZIP دانلود کنند. «کپی جدول» از سلول‌های جداشده با تب برای صفحات گسترده استفاده می‌کند.

پیش‌نمایش‌ها و خروجی‌های جدول از همان استخراج متن استفاده می‌کنند. Word عرض ستون‌ها، فونت‌ها و طرح‌بندی راست‌به‌چپ را در صورت پشتیبانی، به جای اجبار به ستون‌های با اندازه یکسان، حفظ می‌کند. نگاشت‌های فونت مفقود، ترتیب خواندن غیرمعمول و سلول‌های پیچیده یا ادغام‌شده همچنان می‌توانند بر نتیجه تأثیر بگذارند. قبل از استفاده از پیش‌نمایش و مقادیر خروجی، آن‌ها را بررسی کنید.

استفاده از OCR برای صفحات فقط تصویری

استخراج متن یک لایه متنی را می‌خواند؛ حروف موجود در تصاویر را تشخیص نمی‌دهد.

اسکن‌ها، صفحات خالی و OCR

استخراج از یک لایه متنی موجود استفاده می‌کند و حروف موجود در تصاویر صفحه را تشخیص نمی‌دهد. اگر صفحه‌ای متن قابل خواندن ندارد، از PDF OCR به صورت جداگانه استفاده کنید. یک صفحه خالی نیز ممکن است متنی تولید نکند. برای PDFهای ترکیبی، صفحات خالی یا غیرقابل خواندن را به صورت جداگانه بررسی کنید. OCR هر بار یک صفحه انتخاب شده را پردازش می‌کند.

بررسی فایل منبع

از فرمت‌های پذیرفته‌شده استفاده کنید و منابع مورد نیاز را همراه با سند نگه دارید.

الزامات ورودی و تبدیل‌های ناموفق

پسوند نام فایل باید با نوع واقعی فایل مطابقت داشته باشد. تغییر نام یک فایل نامرتبط، آن را تبدیل نمی‌کند. هرگونه منبع مورد نیاز را در داخل سند در دسترس نگه دارید و از فایلی استفاده کنید که رمزگذاری نشده باشد و مجوز پردازش آن را دارید. پردازش ممکن است در محتوای آسیب‌دیده، پشتیبانی‌نشده یا به‌طور غیرعادی پیچیده، حتی زمانی که حجم آن در محدوده مجاز آپلود باشد، با شکست مواجه شود.

فایل‌های پشتیبانی‌شده و پردازش

ورودی
PDF
خروجی
CSV, XLSX, DOCX, TXT, HTML, JSON, XML, ZIP

یک فایل PDF تا 50 مگابایت و 750 صفحه منبع را باز کنید. فایل‌های محافظت‌شده نیاز به یک کپی بازشده دارند مگر اینکه این ابزار صراحتاً امکان ورود رمز عبور را ارائه دهد. صفحات بزرگ یا پیچیده ممکن است به حافظه بیشتری نیاز داشته باشند یا حتی زمانی که فایل در این محدودیت‌ها است، به محدودیت‌های پردازش برسند.

پردازش از سرورهای ما استفاده می‌کند. فایل‌های منبع، فایل‌های موقت و نتایج ظرف ۳۰ دقیقه پس از پایان پردازش از سرورهای ما حذف می‌شوند. ما محتوای اسناد را با اشخاص ثالث به اشتراک نمی‌گذاریم و از آن‌ها برای آموزش مدل‌های هوش مصنوعی استفاده نمی‌کنیم.

Advertisements
سوالات متداول

چند پاسخ مفید

قبل از شروع بدانید چه انتظاری داشته باشید.

پردازش موقت سرور
آیا تشخیص جدول هنگام آپلود به صورت خودکار اجرا می‌شود؟

باز کردن یک فایل PDF آن را برای یافتن جداول اسکن نمی‌کند. گزینه This page یا All pages را انتخاب کرده و هنگام آمادگی روی Detect tables کلیک کنید. تشخیص خودکار ابتدا به دنبال جداول خط‌کشی‌شده می‌گردد و در صفحاتی که جداول خط‌کشی‌شده یافت نمی‌شوند، از تراز متن استفاده می‌کند. یک جدول را انتخاب کنید تا سلول‌های استخراج‌شده آن در زیر PDF بارگذاری شود. برای کنترل خروجی، جداول را تیک بزنید یا تیک آن‌ها را بردارید.

از چه فرمت‌هایی می‌توانم برای جداول استخراج‌شده استفاده کنم؟

Word جداول قابل ویرایش ایجاد می‌کند و می‌تواند هر جدول را در یک صفحه جدید قرار دهد. Excel از یک کاربرگ برای هر جدول استفاده می‌کند. CSV، TXT، HTML، JSON و XML می‌توانند جداول انتخاب‌شده را ترکیب کنند یا فایل‌های جداگانه را در یک ZIP دانلود کنند. کپی جدول از سلول‌های جداشده با تب برای صفحات گسترده استفاده می‌کند.

آیا می‌توانم از استخراج‌کننده جدول PDF برای گزارش‌های اسکن‌شده استفاده کنم؟

استخراج از یک لایه متنی موجود استفاده می‌کند و حروف را در تصاویر صفحه تشخیص نمی‌دهد. اگر صفحه‌ای متن خوانا ندارد، از PDF OCR به‌صورت جداگانه استفاده کنید. یک صفحه خالی نیز ممکن است متنی تولید نکند. برای PDFهای ترکیبی، صفحات خالی یا غیرقابل خواندن را به‌صورت جداگانه بررسی کنید. OCR هر بار یک صفحه انتخاب‌شده را پردازش می‌کند.

محدودیت‌های فایل و صفحه چقدر است؟

یک فایل PDF تا 50 مگابایت و 750 صفحه منبع را باز کنید. فایل‌های محافظت‌شده نیاز به یک کپی بازشده دارند مگر اینکه این ابزار صراحتاً امکان ورود رمز عبور را ارائه دهد. صفحات بزرگ یا پیچیده ممکن است به حافظه بیشتری نیاز داشته باشند یا حتی زمانی که فایل در این محدودیت‌ها است، به محدودیت‌های پردازش برسند.

سند من کجا پردازش می‌شود؟

این ابزار از سرورهای ما برای پردازش استفاده می‌کند. فایل اصلی شما بازنویسی نمی‌شود؛ نتیجه یک دانلود جداگانه است. پیش‌نمایش و نتیجه را در صورت موجود بودن بررسی کنید و قبل از شروع مجدد، کپی مورد نیاز خود را دانلود کنید.

ادامه دهید

دوست دارید مرحله بعد چه کاری انجام دهید؟

یک ابزار انتخاب کنید. PDF نهایی شما همراهتان خواهد بود.

PDF

Advertisements

زبان38

English العربية Français Italiano Deutsch Español Português Nederlands Русский Türkçe 日本語 中文 हिन्दी Bahasa Indonesia Bahasa Melayu 한국어 Tiếng Việt ไทย Polski Svenska Українська Norsk বাংলা Ελληνικά فارسی اردو Čeština Dansk Magyar Română Suomi Български Filipino ქართული Slovenčina Azərbaycanca עברית Slovenščina