Værktøjer150

En nyttig PDF-opgave, gjort enkel

Udtræk e-mails fra PDF.

Gør kontaktoplysninger i din PDF til en ren e-mailliste.

Advertisements
Dit PDF-arbejdsområde
På din enhed
eller slip dine filer her
Din PDF behandles i denne browser. PDF
Advertisements

Sådan udtrækker du e-mails fra PDF

  1. 01

    Vælg én PDF

    Indlæs et dokument med tekst, der kan markeres, eller prøv eksemplet.

  2. 02

    Udtræk og gennemgå

    Vælg Udtræk. Gennemgå værdier, antal og kildesider; filtrér eller sortér listen.

  3. 03

    Kopiér eller download

    Kopiér værdierne, eller download CSV med sidehenvisninger eller en simpel TXT-liste.

BlogSådan udtrækker du e-mailadresser fra en PDFLæs guiden

Udtræk e-mailadresser fra mapper og rapporter

Gør valgbar kontakttekst i en PDF til en genanvendelig e-mailliste. Genkendte adresser inkluderer konventionel e-mailtekst og mailto-linkmål. Gennemse antal og kildesider før kopiering eller Hent.

Genkendte værdier bliver til en liste med kildesidereferencer.
HURTIG VIDEO-VEJLEDNING Sådan udtrækker du e-mailadresser fra en PDF Gør spredte kontaktoplysninger til en ren e-mailliste. Engelsk fortællerstemme Se videoen

Sådan udtrækker du e-mailadresser fra en PDF

Hvornår er dette nyttigt?

Mapper

Indsaml kontaktadresser

Gør en medlems- eller begivenhedsliste til en liste med sideredreferencer.

Forskning

Indsaml forfatterkontakter

Find korrespondanceadresser i artikler, CV'er eller rapporter.

Lange PDF'er

Undgå gentagen kopiering

Gruppér gentagne adresser og inspicér, hvor ofte de optræder.

Funktioner og kontroller

Genkend e-mailadresser

Indsaml adresser fra tekst og e-maillinks.

Understøttede e-mailformer

Udtrækkeren leder efter konventionelle local-part@domain-adresser, inklusive plus-tags og navne med punktum. Den accepterer internationaliserede domænenavne, men ikke ikke-ASCII-postkassenavne, citerede lokale dele eller bevidst slørede adresser.

Adresser sammenlignes uden hensyn til store/små bogstaver, når dubletter fjernes. En identisk synlig adresse og mailto-mål på samme side tælles ikke to gange, blot fordi teksten er klikbar. Ødelagte PDF-tegnkort og adresser, der er ombrudt over flere linjer, kan kræve manuel gennemgang.

Gennemse værdier med deres kildesider

Tjek antal, hop til en PDF-side, og filtrer resultatlisten.

Gennemse og organiser

Hvert resultat registrerer den fysiske sideplacering i PDF'en, hvilket kan afvige fra trykte sidetal. Vælg et side-chip for at åbne forhåndsvisningen med en omtrentlig markering.

Fjern dubletter er aktiveret som standard. Antal kombinerer genkendte gentagelser af den samme værdi; slå det fra for at se separate forekomster. Sortér alfabetisk ændrer listens rækkefølge. Filtrering gælder også for kopiering og Hent samt de synlige rækker.

Kopiér værdier eller Hent en struktureret liste

Vælg CSV for antal og sider, eller TXT for én værdi pr. linje.

Hvad hver Hent indeholder

CSV indeholder kolonnerne Type, Værdi, Antal og Sider. UTF-8-kodning understøtter arabisk og andre skrifttyper. Værdier, der kan tolkes som regnearksformler, får tilføjet en apostrof for sikrere import.

TXT og Kopiér alt indeholder kun værdier, én pr. linje. Alle rækker, der matcher filteret, er inkluderet, selv når tabellen på skærmen strækker sig over flere resultatsider. Ingen ny PDF oprettes, og kilde-PDF'en forbliver uændret.

Hold store udtrækninger håndterbare

Behandl én PDF i din browser med eksplicitte grænser og meddelelser om delvise resultater.

Filer, grænser og scannede sider

Indlæs én PDF på op til 50 MiB og 500 sider. Udtrækning tjekker op til 250.000 tegn og 2.000 matches pr. side, 10 millioner tegn og 20.000 matches i alt, samt 2.000 annotationer pr. side. Et budget på 90 sekunder til udtrækning begrænser lange kørsler. Meget komplekse dokumenter kan fungere bedre, når de opdeles i mindre filer.

Når en grænse nås, eller en side ikke kan læses fuldt ud, viser resultaterne en meddelelse, og begrænsede eller mislykkede kørsler eksporteres med partial i filnavnet. Sider uden valgbar tekst tælles separat. Brug PDF OCR til billed-kun scanninger, og vend derefter tilbage for at udtrække den genkendte tekst.

PDF-indhold behandles lokalt i denne browser. Uploadede dokumenter sendes ikke til en udtrækningsserver. Links, e-mailadresser og telefonnumre fundet i PDF'en kontaktes aldrig automatisk.

Understøttede filer og behandling

Input
PDF
Output
CSV / TXT

Åbn én PDF på op til 50 MB og 750 sider. Yderligere grænser for output, hukommelse og behandling kan gælde for komplekse dokumenter.

Behandlingen foregår på din enhed uden upload af dokumentet. Download dit resultat, før du lukker siden; gem originalen separat.

Advertisements
FAQ

Et par nyttige svar

Vid hvad du kan forvente, før du starter.

På din enhed
Hvad kan dette værktøj genkende?

Gør valgbar kontakttekst i én PDF til en genanvendelig e-mailliste. Genkendte adresser inkluderer konventionel e-mailtekst og mailto-linkmål. Gennemse antal og kildesider før kopiering eller hentning. scannede sider og slørede adresser såsom navn [at] eksempel [dot] org kræver forberedelse. Dette værktøj verificerer ikke levering, ejerskab eller samtykke til at kontakte nogen.

Kan jeg udtrække data fra scannede PDF'er?

Kun valgbar tekst og genkendte linkmål læses. Sider, der kun består af billeder, kræver først PDF OCR. Kør OCR, hent den søgbare PDF, og vend derefter tilbage til denne ekstraktor.

Hvordan håndteres dubletter og antal?

Fjern dubletter kombinerer genkendte ækvivalente værdier. Antal viser detekterede forekomster, og Sider viser de fysiske PDF-sideplaceringer. Deaktiver indstillingen for at holde forekomster adskilt. Et printet mål og et matchende klikbart link på samme side tælles ikke dobbelt.

Hvad er forskellen på CSV og TXT?

CSV inkluderer type, værdi, antal forekomster og sidehenvisninger. TXT og Kopiér alt leverer kun værdier, én pr. linje. Alle rækker, der matcher det aktuelle filter, inkluderes, ikke kun den synlige tabelside.

Er PDF'en uploadet til udtrækning?

Nej. PDF-parsing, matchning og eksport kører i denne browser. Den originale PDF er uændret. Intet udtrukket link, e-mail eller telefonnummer kontaktes automatisk.

Hvad er begrænsningerne?

Én PDF på op til 50 MiB og 500 sider. Udtrækning er begrænset til 250.000 teksttegn og 2.000 match pr. side, 10 millioner tegn og 20.000 match i alt, samt 2.000 annoteringer pr. side. Resultaterne bærer en meddelelse, hvis begrænsninger eller ulæselige sider gør dem ufuldstændige.

Fortsæt

Hvad vil du gøre nu?

Vælg et værktøj. Din færdige PDF følger med dig.

PDF

Advertisements

Sprog38

English العربية Français Italiano Deutsch Español Português Nederlands Русский Türkçe 日本語 中文 हिन्दी Bahasa Indonesia Bahasa Melayu 한국어 Tiếng Việt ไทย Polski Svenska Українська Norsk বাংলা Ελληνικά فارسی اردو Čeština Dansk Magyar Română Suomi Български Filipino ქართული Slovenčina Azərbaycanca עברית Slovenščina