Verktøy150

En nyttig PDF-oppgave, gjort enkel

Trekk ut e-poster fra PDF.

Gjør kontaktdetaljer i PDF-en din om til en ren e-postliste.

Advertisements
Ditt PDF-arbeidsområde
På enheten din
eller slipp filene dine her
PDF-en din behandles i denne nettleseren. PDF
Advertisements

Hvordan trekke ut e-poster fra PDF

  1. 01

    Velg én PDF

    Last inn et dokument med tekst som kan velges, eller prøv eksempelet.

  2. 02

    Trekk ut og gå gjennom

    Velg Trekk ut. Gå gjennom verdier, antall og kildesider; filtrer eller sorter listen.

  3. 03

    Kopier eller last ned

    Kopier verdiene, eller last ned CSV med sidehenvisninger eller en enkel TXT-liste.

BloggHvordan trekke ut e-postadresser fra en PDFLes guiden

Trekk ut e-postadresser fra kataloger og rapporter

Gjør valgbar kontakttekst i en PDF om til en gjenbrukbar e-postliste. Gjenkjente adresser inkluderer konvensjonell e-posttekst og mailto-lenkemål. Gå gjennom antall og kildesider før du kopierer eller laster ned.

Gjenkjente verdier blir til en liste med referanser til kildesider.
RASK VIDEOVEILEDNING Hvordan trekke ut e-postadresser fra en PDF Gjør spredte kontaktdetaljer om til en ryddig e-postliste. Engelsk fortellerstemme Se videoen

Hvordan trekke ut e-postadresser fra en PDF

Når er dette nyttig?

Kataloger

Samle kontaktadresser

Gjør en medlems- eller arrangementskatalog om til en liste med sideoppføringer.

Forskning

Samle forfatterkontakter

Finn korrespondanseadresser i artikler, CV-er eller rapporter.

Lange PDF-er

Unngå gjentatt kopiering

Grupper gjentatte adresser og inspiser hvor ofte de forekommer.

Funksjoner og kontroller

Gjenkjenn e-postadresser

Samle adresser fra tekst og e-postlenker.

Støttede e-postformater

Ekstraktoren ser etter konvensjonelle local-part@domain-adresser, inkludert pluss-tagger og navn med punktum. Den godtar internasjonaliserte domenenavn, men ikke ikke-ASCII-postkassenavn, siterte lokale deler eller bevisst tilslørte adresser.

Adresser sammenlignes uten å skille mellom store og små bokstaver ved fjerning av duplikater. En identisk synlig adresse og mailto-mål på samme side telles ikke to ganger bare fordi teksten er klikkbar. Ødelagte PDF-tegnkart og adresser som er brutt over flere linjer kan kreve manuell gjennomgang.

Gjennomgå verdier med kildesidene deres

Sjekk antall, hopp til en PDF-side, og filtrer resultatlisten.

Gjennomgå og organiser

Hvert resultat registrerer den fysiske sideposisjonen i PDF-en, som kan avvike fra trykte sidetall. Velg en sidebrikke for å åpne forhåndsvisningen med en omtrentlig utheving.

Fjern duplikater er aktivert som standard. Antall kombinerer gjenkjente repetisjoner av samme verdi; slå den av for å se separate forekomster. Sorter alfabetisk endrer listerekkefølgen. Filtrering gjelder for kopiering og nedlasting, så vel som for de synlige radene.

Kopier verdier eller last ned en strukturert liste

Velg CSV for antall og sider, eller TXT for én verdi per linje.

Hva hver nedlasting inneholder

CSV inneholder kolonnene Type, Verdi, Antall og Sider. UTF-8-koding støtter arabisk og andre skrifttyper. Verdier som kan tolkes som regnearkformler, får et apostrof-prefiks for tryggere import.

TXT og Kopier alle inneholder kun verdier, én per linje. Alle rader som samsvarer med filteret er inkludert, selv når tabellen på skjermen strekker seg over flere resultatsider. Ingen ny PDF opprettes, og kilde-PDF-en forblir uendret.

Hold store uttrekk håndterbare

Behandle én PDF i nettleseren din, med eksplisitte grenser og varsler om delvise resultater.

Filer, grenser og skannede sider

Last inn én PDF på opptil 50 MiB og 500 sider. Uttrekk sjekker opptil 250 000 tegn og 2 000 treff per side, 10 millioner tegn og 20 000 treff totalt, samt 2 000 annoteringer per side. Et 90-sekunders uttrekksbudsjett begrenser lange kjøringer. Svært komplekse dokumenter kan fungere bedre når de deles opp i mindre filer.

Når en grense nås eller en side ikke kan leses fullstendig, viser resultatene et varsel, og begrensede eller mislykkede kjøringer eksporteres med «partial» i filnavnet. Sider uten valgbar tekst telles separat. Bruk PDF OCR for bildebaserte skanninger, og gå deretter tilbake for å trekke ut den gjenkjente teksten.

PDF-innhold behandles lokalt i denne nettleseren. Opplastede dokumenter sendes ikke til en uttrekks-server. Lenker, e-postadresser og telefonnumre funnet i PDF-en blir aldri kontaktet automatisk.

Støttede filer og behandling

Inndata
PDF
Utdata
CSV / TXT

Åpne én PDF på opptil 50 MB og 750 sider. Ytterligere begrensninger for utdata, minne og behandling kan gjelde for komplekse dokumenter.

Behandlingen skjer på enheten din uten at dokumentet lastes opp. Last ned resultatet før du lukker siden; ta vare på originalen separat.

Advertisements
FAQ

Noen nyttige svar

Vit hva du kan forvente før du starter.

På enheten din
Hva kan dette verktøyet gjenkjenne?

Gjør valgbar kontakttekst i én PDF om til en gjenbrukbar e-postliste. Gjenkjente adresser inkluderer konvensjonell e-posttekst og mailto-lenkemål. Se gjennom antall og kildesider før du kopierer eller laster ned. Skannede sider og tilslørte adresser som navn [at] eksempel [dot] org trenger forberedelse. Dette verktøyet verifiserer ikke levering, eierskap eller samtykke til å kontakte noen.

Kan jeg hente ut data fra skannede PDF-er?

Kun valgbar tekst og gjenkjente lenkemål leses. Sider som kun består av bilder trenger PDF-OCR først. Kjør OCR, last ned den søkbare PDF-en, og gå deretter tilbake til denne ekstraktoren.

Hvordan håndteres duplikater og antall?

Fjern duplikater kombinerer gjenkjente like verdier. Antall viser oppdagede forekomster og Sider lister opp fysiske PDF-sideplasseringer. Deaktiver alternativet for å beholde forekomster separat. Et utskrevet mål og en matchende klikkbar lenke på samme side telles ikke dobbelt.

Hva er forskjellen på CSV og TXT?

CSV inkluderer type, verdi, antall forekomster og sidehenvisninger. TXT og Kopier alle gir kun verdier, én per linje. Alle rader som samsvarer med gjeldende filter inkluderes, ikke bare den synlige tabellsiden.

Blir PDF-en lastet opp for uttrekk?

Nei. PDF-parsing, samsvarskontroll og eksport kjøres i denne nettleseren. Den originale PDF-en forblir uendret. Ingen uttrukket lenke, e-post eller telefonnummer kontaktes automatisk.

Hva er begrensningene?

Én PDF på opptil 50 MiB og 500 sider. Ekstraksjon er begrenset til 250 000 teksttegn og 2 000 treff per side, 10 millioner tegn og 20 000 treff totalt, samt 2 000 merknader per side. Resultatene inneholder et varsel hvis begrensninger eller uleselige sider gjør dem delvise.

Fortsett

Hva vil du gjøre videre?

Velg et verktøy. Den ferdige PDF-en din følger med deg.

PDF

Advertisements

Språk38

English العربية Français Italiano Deutsch Español Português Nederlands Русский Türkçe 日本語 中文 हिन्दी Bahasa Indonesia Bahasa Melayu 한국어 Tiếng Việt ไทย Polski Svenska Українська Norsk বাংলা Ελληνικά فارسی اردو Čeština Dansk Magyar Română Suomi Български Filipino ქართული Slovenčina Azərbaycanca עברית Slovenščina