Alətlər150

Faydalı PDF tapşırığı, sadələşdirilmiş formada

PDF-dən məlumatları çıxarın.

Ehtiyacınız olan məlumatı tapın. Hər nəticə ilə birlikdə mənbə səhifəsini saxlayın.

Advertisements
PDF iş sahəniz
Cihazınızda
və ya fayllarınızı bura atın
PDF-iniz bu brauzerdə emal edilir. PDF
Advertisements

PDF-dən məlumatları necə çıxarmaq olar

  1. 01

    Bir PDF seçin

    Seçilə bilən mətni olan sənəd yükləyin və ya nümunəni sınayın.

  2. 02

    Çıxarın və nəzərdən keçirin

    Çıxar düyməsini seçin. Dəyərləri, sayları və mənbə səhifələrini nəzərdən keçirin; siyahını filtrləyin və ya sıralayın.

  3. 03

    Kopyalayın və ya yükləyin

    Dəyərləri kopyalayın və ya səhifə istinadları ilə CSV, yaxud sadə TXT siyahısı yükləyin.

BloqPDF-dən strukturlaşdırılmış məlumatları necə çıxarmaq olarTəlimatı oxuyun

PDF-dən strukturlaşdırılmış dəyərləri CSV və ya mətnə çıxarın

Ehtiyacınız olan məlumat növlərini seçin: e-poçtlar, telefon nömrələri, URL-lər, rəqəmsal tarixlər, IPv4 ünvanları, domenlər, DOI, ISBN, heşteqlər və MAC ünvanları. Çıxarılan dəyərləri saylar və səhifə istinadları ilə nəzərdən keçirin.

Tanınan dəyərlər mənbə səhifə istinadları ilə birlikdə siyahıya çevrilir.
QISA VİDEO TƏLİMAT PDF-dən strukturlaşdırılmış məlumatları necə çıxarmaq olar Əlaqələri və tədqiqat identifikatorlarını bir mütəşəkkil siyahıda toplayın. İngiliscə təhkiyə Videoya baxın

PDF-dən strukturlaşdırılmış məlumatları necə çıxarmaq olar

Bu nə vaxt faydalıdır?

Tədqiqat

İdentifikatorları toplayın

DOI və ISBN dəyərlərini göründükləri səhifələrlə birlikdə toplayın.

Hesabatlar

Rəqəmsal detalları çıxarın

Tarixli qeydləri və IPv4 ünvanlarını tapın.

Kataloqlar

Əlaqə siyahısı yaradın

E-poçtları, telefonları və veb keçidləri bir strukturlaşdırılmış ixracda birləşdirin.

Xüsusiyyətlər və idarəetmələr

Faydalı məlumat növlərini seçin

E-poçtlar, telefonlar və URL-lərlə başlayın, sonra xüsusi dəyərlər üçün Daha çox məlumat növü bölməsini açın.

Tanıyıcılar nəyi dəstəkləyir

Tarixlər dörd rəqəmli il ilə rəqəmsal formatdan istifadə etməlidir; qeyri-müəyyən gün/ay dəyərləri mənbə ardıcıllığını saxlayır. IPv4 oktetləri yoxlanılır; IPv6 daxil edilmir.

Domenlər ixtiyari fayl adlarından deyil, tanınan e-poçtlar və veb keçidlərdən əldə edilir. DOI çıxarılması hər tarixi formanı deyil, ümumi müasir DOI formalarını əhatə edir. ISBN-13 dəyərləri etibarlı yoxlama cəminə ehtiyac duyur; ISBN-10 həm də ISBN etiketini tələb edir. Hashtag-lər ərəb dili daxil olmaqla Unicode hərflərini ehtiva edə bilər.

MAC ünvanları altı qoşa nöqtə və ya tire ilə ayrılmış cütlərdən istifadə edir. Alət heç vaxt çıxarılan ünvanlar və ya identifikatorlarla əlaqə saxlamır.

Dəyərləri mənbə səhifələri ilə nəzərdən keçirin

Sayları yoxlayın, PDF səhifəsinə keçin və nəticə siyahısını filtrləyin.

Nəzərdən keçirin və təşkil edin

Hər bir nəticə PDF-dəki fiziki səhifə mövqeyini qeyd edir, bu da çap olunmuş səhifə nömrələrindən fərqli ola bilər. Önizləməni təxmini vurğulama ilə açmaq üçün səhifə çipini seçin.

Dublikatları sil funksiyası aktiv vəziyyətdə başlayır. Saylar eyni dəyərin tanınan təkrarını birləşdirir; ayrı-ayrı halları görmək üçün onu söndürün. Əlifba sırası ilə çeşidləmə siyahının ardıcıllığını dəyişir. Filtrələmə görünən sətirlərlə yanaşı, kopyalama və yükləmələrə də tətbiq olunur.

Dəyərləri kopyalayın və ya strukturlaşdırılmış siyahını yükləyin

Saylar və səhifələr üçün CSV, və ya hər sətirdə bir dəyər üçün TXT seçin.

Hər yükləmədə nə var

CSV Type, Value, Count və Pages sütunlarını ehtiva edir. UTF-8 kodlaşdırması ərəb və digər skriptləri dəstəkləyir. Cədvəl düsturları kimi şərh edilə bilən dəyərlər daha təhlükəsiz idxal üçün apostrof ilə prefikslənir.

TXT və Hamısını kopyala yalnız dəyərləri, hər sətirdə bir dənə olmaqla ehtiva edir. Ekrandakı cədvəl bir neçə nəticə səhifəsinə yayıldıqda belə, filtrə uyğun gələn bütün sətirlər daxil edilir. Yeni PDF yaradılmır və mənbə PDF dəyişdirilmir.

Böyük çıxarışları idarəolunan saxlayın

Dəqiq limitlər və qismən nəticə bildirişləri ilə brauzerinizdə bir PDF-i emal edin.

Fayllar, limitlər və skan edilmiş səhifələr

50 MiB-ə qədər və 500 səhifəlik bir PDF yükləyin. Çıxarış hər səhifə üçün 250.000 simvola və 2.000 uyğunluğa, ümumilikdə 10 milyon simvola və 20.000 uyğunluğa, hər səhifə üçün isə 2.000 annotasiyaya qədər yoxlama aparır. 90 saniyəlik çıxarış büdcəsi uzun prosesləri məhdudlaşdırır. Çox mürəkkəb sənədlər daha kiçik fayllara bölündükdə daha yaxşı işləyə bilər.

Limitə çatıldıqda və ya səhifə tam oxuna bilmədikdə, nəticələr bildiriş göstərir və məhdud və ya uğursuz işləmələr fayl adında partial ilə ixrac olunur. Seçilə bilən mətni olmayan səhifələr ayrıca sayılır. Yalnız şəkil olan skanlar üçün PDF OCR-dən istifadə edin, sonra tanınan mətni çıxarmaq üçün geri qayıdın.

PDF məzmunu bu brauzerdə yerli olaraq emal edilir. Yüklənmiş sənədlər çıxarış serverinə göndərilmir. PDF daxilində tapılan keçidlər, e-poçt ünvanları və telefon nömrələri heç vaxt avtomatik olaraq əlaqələndirilmir.

Dəstəklənən fayllar və emal

Giriş
PDF
Çıxış
CSV / TXT

50 MB-a qədər və 750 səhifəlik bir PDF açın. Mürəkkəb sənədlər üçün əlavə çıxış, yaddaş və emal limitləri tətbiq oluna bilər.

Emal sənədi yükləmədən cihazınızda baş verir. Səhifəni bağlamazdan əvvəl nəticənizi yükləyin; orijinalı ayrıca saxlayın.

Advertisements
Tez-tez verilən suallar

Bir neçə faydalı cavab

Başlamazdan əvvəl nə gözlədiyinizi bilin.

Cihazınızda
Bu alət nəyi tanıya bilir?

Ehtiyacınız olan məlumat növlərini seçin: e-poçtlar, telefon nömrələri, URL-lər, rəqəmsal tarixlər, IPv4 ünvanları, domenlər, DOI, ISBN, heşteqlər və MAC ünvanları. Çıxarılan dəyərləri saylar və səhifə istinadları ilə nəzərdən keçirin. Bu, cədvəlləri, fakturaları və ya semantik sahələri deyil, tanınan dəyərləri çıxarır. Nümunələr və yoxlama cəmləri (checksums) küyü azaldır, lakin tamlığına zəmanət vermir və ya identifikatorun orijinal olduğunu sübut etmir.

Skan edilmiş PDF-lərdən məlumat çıxara bilərəmmi?

Yalnız seçilə bilən mətn və tanınan keçid hədəfləri oxunur. Yalnız şəkil olan səhifələr üçün əvvəlcə PDF OCR lazımdır. OCR-i işə salın, axtarıla bilən PDF-i Yüklə-yin, sonra bu çıxarıcıya qayıdın.

Dublikatlar və saylar necə idarə olunur?

Dublikatları sil funksiyası tanınan ekvivalent dəyərləri birləşdirir. Say aşkar edilmiş halları göstərir, Səhifələr isə fiziki PDF səhifə mövqelərini sadalayır. Hadisələri ayrı saxlamaq üçün bu seçimi deaktiv edin. Eyni səhifədəki çap olunmuş hədəf və uyğun kliklənə bilən keçid iki dəfə sayılmır.

CSV və TXT arasındakı fərq nədir?

CSV növü, dəyəri, hadisə sayını və səhifə istinadlarını əhatə edir. TXT və Hamısını kopyala yalnız dəyərləri, hər sətirdə bir olmaqla təqdim edir. Cari filtrə uyğun gələn bütün sətirlər, yalnız görünən cədvəl səhifəsi deyil, daxil edilir.

PDF çıxarış üçün yüklənirmi?

Xeyr. PDF təhlili, uyğunlaşdırma və ixrac bu brauzerdə işləyir. Orijinal PDF dəyişdirilmir. Çıxarılan heç bir keçid, e-poçt və ya telefon nömrəsi ilə avtomatik əlaqə saxlanılmır.

Məhdudiyyətlər nələrdir?

50 MiB-a qədər və 500 səhifəlik bir PDF. Çıxarış hər səhifə üçün 250.000 mətn simvolu və 2.000 uyğunluq, ümumilikdə 10 milyon simvol və 20.000 uyğunluq, həmçinin hər səhifə üçün 2.000 annotasiya ilə məhdudlaşdırılıb. Məhdudiyyətlər və ya oxunmaz səhifələr nəticələri qismən edərsə, nəticələrdə bildiriş göstərilir.

Davam edin

Bundan sonra nə etmək istərdiniz?

Bir alət seçin. Hazır PDF-iniz sizinlə qalacaq.

PDF

Advertisements

Dil38

English العربية Français Italiano Deutsch Español Português Nederlands Русский Türkçe 日本語 中文 हिन्दी Bahasa Indonesia Bahasa Melayu 한국어 Tiếng Việt ไทย Polski Svenska Українська Norsk বাংলা Ελληνικά فارسی اردو Čeština Dansk Magyar Română Suomi Български Filipino ქართული Slovenčina Azərbaycanca עברית Slovenščina