Instrumente150

O sarcină PDF utilă, simplificată

Extrage emailuri din PDF.

Transformă detaliile de contact din PDF-ul tău într-o listă de emailuri curată.

Advertisements
Spațiul dvs. de lucru PDF
Pe dispozitivul tău
sau plasați fișierele aici
PDF-ul tău este procesat în acest browser. PDF
Advertisements

Cum să extragi adrese de e-mail dintr-un PDF

  1. 01

    Alege un PDF

    Încarcă un document cu text selectabil sau încearcă exemplul.

  2. 02

    Extrage și verifică

    Selectează Extrage. Verifică valorile, numărătorile și paginile sursă; filtrează sau sortează lista.

  3. 03

    Copiază sau descarcă

    Copiază valorile sau descarcă CSV cu referințe de pagină ori o listă TXT simplă.

BlogCum să extragi adrese de e-mail dintr-un PDFCitește ghidul

Extrage adrese de e-mail din directoare și rapoarte

Transformă textul de contact selectabil dintr-un PDF într-o listă de e-mailuri reutilizabilă. Adresele recunoscute includ textul convențional de e-mail și țintele linkurilor mailto. Verifică numărul și paginile sursă înainte de a copia sau descărca.

Valorile recunoscute devin o listă cu referințe la paginile sursă.
TUTORIAL VIDEO RAPID Cum să extragi adrese de e-mail dintr-un PDF Transformă detaliile de contact împrăștiate într-o listă de e-mailuri curată. Narațiune în engleză Urmărește videoclipul

Cum să extragi adrese de e-mail dintr-un PDF

Când este util acest lucru?

Directoare

Colectează adrese de contact

Transformă un director de membri sau evenimente într-o listă cu referințe la pagini.

Cercetare

Adună contactele autorilor

Găsește adrese de corespondență în lucrări, CV-uri sau rapoarte.

PDF-uri lungi

Evită copierea repetată

Grupează adresele repetate și inspectează frecvența apariției lor.

Funcționalități și controale

Recunoaște adresele de e-mail

Colectează adrese din text și linkuri de e-mail.

Formate de e-mail acceptate

Extractorul caută adrese convenționale local-part@domain, inclusiv etichete plus și nume cu puncte. Acceptă nume de domenii internaționalizate, dar nu nume de căsuțe poștale non-ASCII, părți locale citate sau adrese deliberat ofuscate.

Adresele sunt comparate fără a ține cont de majuscule/minuscule la eliminarea duplicatelor. O adresă vizibilă identică și o țintă mailto pe aceeași pagină nu sunt numărate de două ori doar pentru că textul este clicabil. Hărțile de caractere PDF corupte și adresele fragmentate pe mai multe linii pot necesita revizuire manuală.

Revizuiește valorile cu paginile lor sursă

Verifică numărătoarea, sari la o pagină PDF și filtrează lista de rezultate.

Revizuiește și organizează

Fiecare rezultat înregistrează poziția fizică a paginii în PDF, care poate diferi de numerele paginilor imprimate. Selectează un cip de pagină pentru a deschide previzualizarea cu o evidențiere aproximativă.

Eliminarea duplicatelor este activată implicit. Numărătoarea combină repetițiile recunoscute ale aceleiași valori; dezactivează opțiunea pentru a vedea aparițiile separate. Sortarea alfabetică schimbă ordinea listei. Filtrarea se aplică atât copierii și descărcărilor, cât și rândurilor vizibile.

Copiază valorile sau descarcă o listă structurată

Alege CSV pentru numărători și pagini, sau TXT pentru o valoare pe linie.

Ce conține fiecare descărcare

CSV conține coloanele Tip, Valoare, Număr și Pagini. Codificarea UTF-8 suportă araba și alte scripturi. Valorile care ar putea fi interpretate ca formule de calcul tabelar sunt prefixate cu un apostrof pentru o importare mai sigură.

TXT și Copierea conțin doar valori, una pe linie. Toate rândurile care corespund filtrului sunt incluse, chiar și atunci când tabelul de pe ecran se întinde pe mai multe pagini de rezultate. Nu se creează niciun PDF nou, iar PDF-ul sursă rămâne neschimbat.

Păstrează extracțiile mari gestionabile

Procesează un PDF în browserul tău, cu limite explicite și notificări de rezultate parțiale.

Fișiere, limite și pagini scanate

Încarcă un PDF de până la 50 MiB și 500 de pagini. Extragerea verifică până la 250.000 de caractere și 2.000 de potriviri pe pagină, 10 milioane de caractere și 20.000 de potriviri în total, și 2.000 de adnotări pe pagină. Un buget de 90 de secunde pentru extragere limitează rulările lungi. Documentele foarte complexe pot funcționa mai bine dacă sunt împărțite în fișiere mai mici.

Când se atinge o limită sau o pagină nu poate fi citită complet, rezultatele afișează o notificare, iar rulările limitate sau eșuate se exportă cu mențiunea parțial în numele fișierului. Paginile fără text selectabil sunt numărate separat. Utilizează OCR PDF pentru scanări doar cu imagini, apoi revino pentru a extrage textul recunoscut.

Conținutul PDF este procesat local în acest browser. Documentele încărcate nu sunt trimise către un server de extragere. Linkurile, adresele de e-mail și numerele de telefon găsite în interiorul PDF-ului nu sunt niciodată contactate automat.

Fișiere și procesare acceptate

Intrare
PDF
Ieșire
CSV / TXT

Deschideți un PDF de până la 50 MB și 750 pagini. Limite suplimentare de ieșire, memorie și procesare se pot aplica documentelor complexe.

Procesarea are loc pe dispozitivul dvs. fără a încărca documentul. Descărcați rezultatul înainte de a închide pagina; păstrați originalul separat.

Advertisements
Întrebări frecvente

Câteva răspunsuri utile

Știți la ce să vă așteptați înainte de a începe.

Pe dispozitivul tău
Ce poate recunoaște acest instrument?

Transformați textul de contact selectabil dintr-un PDF într-o listă de e-mailuri reutilizabilă. Adresele recunoscute includ textul convențional de e-mail și țintele link-urilor mailto. Examinați numărătoarea și paginile sursă înainte de a copia sau descărca. Paginile scanate și adresele mascate, cum ar fi name [at] example [dot] org, necesită pregătire. Acest instrument nu verifică livrarea, proprietatea sau consimțământul de a contacta pe cineva.

Pot extrage date din PDF-uri scanate?

Sunt citite doar textul selectabil și țintele de link recunoscute. Paginile care conțin doar imagini necesită mai întâi OCR pentru PDF. Rulați OCR, descărcați PDF-ul care poate fi căutat, apoi reveniți la acest extractor.

Cum sunt gestionate duplicatele și numărătoarea?

Eliminarea duplicatelor combină valorile echivalente recunoscute. Coloana Count afișează aparițiile detectate, iar Pages listează pozițiile fizice ale paginilor din PDF. Dezactivați opțiunea pentru a păstra aparițiile separate. O țintă tipărită și un link clicabil corespondent pe aceeași pagină nu sunt numărate dublu.

Care este diferența dintre CSV și TXT?

CSV include tipul, valoarea, numărul de apariții și referințele paginilor. TXT și Copy all oferă doar valorile, una pe linie. Toate rândurile care corespund filtrului curent sunt incluse, nu doar pagina vizibilă a tabelului.

PDF-ul este încărcat pentru extragere?

Nu. Analiza, potrivirea și exporturile PDF rulează în acest browser. PDF-ul original rămâne neschimbat. Niciun link, e-mail sau număr de telefon extras nu este contactat automat.

Care sunt limitele?

Un PDF de până la 50 MiB și 500 de pagini. Extracția este limitată la 250.000 de caractere text și 2.000 de potriviri pe pagină, 10 milioane de caractere și 20.000 de potriviri în total, și 2.000 de adnotări pe pagină. Rezultatele conțin o notificare dacă limitele sau paginile ilizibile le fac parțiale.

Continuă

Ce ai dori să faci în continuare?

Alege un instrument. PDF-ul tău finalizat te însoțește.

PDF

Advertisements

Limba38

English العربية Français Italiano Deutsch Español Português Nederlands Русский Türkçe 日本語 中文 हिन्दी Bahasa Indonesia Bahasa Melayu 한국어 Tiếng Việt ไทย Polski Svenska Українська Norsk বাংলা Ελληνικά فارسی اردو Čeština Dansk Magyar Română Suomi Български Filipino ქართული Slovenčina Azərbaycanca עברית Slovenščina