Samla kontaktadresser
Omvandla en medlems- eller evenemangskatalog till en lista med sidreferenser.
Gör om kontaktuppgifter i din PDF till en ren e-postlista.
| Typ | Värde | Antal | Sidor |
|---|
Kopiering och nedladdning inkluderar alla matchande rader över alla resultatsidor. CSV inkluderar antal och PDF-sidnummer; TXT innehåller endast värden.
Välj ett sidnummer i Resultat för att kontrollera källan. Markeringar visar ungefärliga positioner.
Din lista är klar. Ladda ner den eller gå tillbaka för att granska och ändra format.
Ladda ett dokument med valbar text, eller prova exemplet.
Välj Extrahera. Granska värden, antal och källsidor; filtrera eller sortera listan.
Kopiera värdena, eller ladda ner CSV med sidreferenser eller en enkel TXT-lista.
Omvandla valbar kontakttext i en PDF till en återanvändbar e-postlista. Identifierade adresser inkluderar konventionell e-posttext och mailto-länkmål. Granska antal och källsidor innan du kopierar eller laddar ner.
Omvandla en medlems- eller evenemangskatalog till en lista med sidreferenser.
Hitta korrespondensadresser i artiklar, CV:n eller rapporter.
Gruppera upprepade adresser och inspektera hur ofta de förekommer.
Samla adresser från text och e-postlänkar.
Extraheraren letar efter konventionella local-part@domain-adresser, inklusive plustaggar och punktnamn. Den accepterar internationaliserade domännamn men inte icke-ASCII-brevlådenamn, citerade lokala delar eller avsiktligt förvrängda adresser.
Adresser jämförs utan att ta hänsyn till skiftläge vid borttagning av dubbletter. En identisk synlig adress och mailto-mål på samma sida räknas inte två gånger bara för att texten är klickbar. Trasiga PDF-teckenkartor och adresser som brutits över flera rader kan kräva manuell granskning.
Kontrollera antal, hoppa till en PDF-sida och filtrera resultatlistan.
Varje resultat registrerar den fysiska sidpositionen i PDF-filen, vilket kan skilja sig från tryckta sidnummer. Välj en sidmarkör för att öppna förhandsgranskningen med en ungefärlig markering.
Ta bort dubbletter är aktiverat som standard. Antal kombinerar igenkända upprepningar av samma värde; stäng av för att se separata förekomster. Sortera alfabetiskt ändrar listans ordning. Filtrering gäller både kopiering och nedladdningar samt de synliga raderna.
Välj CSV för antal och sidor, eller TXT för ett värde per rad.
CSV innehåller kolumnerna Typ, Värde, Antal och Sidor. UTF-8-kodning stöder arabiska och andra skript. Värden som kan tolkas som kalkylbladsformler föregås av en apostrof för säkrare import.
TXT och Kopiera alla innehåller endast värden, ett per rad. Alla rader som matchar filtret inkluderas, även när tabellen på skärmen sträcker sig över flera resultatsidor. Ingen ny PDF skapas och käll-PDF-filen förblir oförändrad.
Bearbeta en PDF i din webbläsare, med explicita gränser och meddelanden om partiella resultat.
Ladda en PDF på upp till 50 MiB och 500 sidor. Extraheringen kontrollerar upp till 250 000 tecken och 2 000 matchningar per sida, 10 miljoner tecken och 20 000 matchningar totalt, samt 2 000 anteckningar per sida. En tidsbudget på 90 sekunder begränsar långa körningar. Mycket komplexa dokument kan fungera bättre om de delas upp i mindre filer.
När en gräns nås eller en sida inte kan läsas fullständigt, visar resultaten ett meddelande och begränsade eller misslyckade körningar exporteras med partial i filnamnet. Sidor utan valbar text räknas separat. Använd PDF OCR för bildbaserade skanningar, återvänd sedan för att extrahera den igenkända texten.
PDF-innehåll bearbetas lokalt i denna webbläsare. Uppladdade dokument skickas inte till en extraheringsserver. Länkar, e-postadresser och telefonnummer som hittas i PDF-filen kontaktas aldrig automatiskt.
Öppna en PDF på upp till 50 MB och 750 sidor. Ytterligare begränsningar för utdata, minne och bearbetning kan gälla för komplexa dokument.
Bearbetningen sker på din enhet utan att dokumentet laddas upp. Ladda ner resultatet innan du stänger sidan; spara originalet separat.
Vet vad du kan förvänta dig innan du börjar.
På din enhetOmvandla valbar kontakttext i en PDF till en återanvändbar e-postlista. Identifierade adresser inkluderar konventionell e-posttext och mailto-länkmål. Granska antal och källsidor innan du kopierar eller laddar ner. Skannade sidor och maskerade adresser som namn [at] exempel [dot] org kräver förberedelse. Detta verktyg verifierar inte leverans, ägarskap eller samtycke för att kontakta någon.
Endast valbar text och identifierade länkmål läses. Sidor som endast består av bilder behöver först PDF-OCR. Kör OCR, ladda ner den sökbara PDF-filen och återvänd sedan till denna extraktor.
Ta bort dubbletter kombinerar identifierade likvärdiga värden. Antal visar upptäckta förekomster och Sidor listar fysiska PDF-sidpositioner. Inaktivera alternativet för att behålla förekomster separata. Ett utskrivet mål och en matchande klickbar länk på samma sida räknas inte dubbelt.
CSV inkluderar typ, värde, antal förekomster och sidreferenser. TXT och Kopiera alla tillhandahåller endast värden, ett per rad. Alla rader som matchar det aktuella filtret inkluderas, inte bara den synliga tabellsidan.
Nej. PDF-tolkning, matchning och export körs i denna webbläsare. Den ursprungliga PDF-filen förblir oförändrad. Ingen extraherad länk, e-postadress eller telefonnummer kontaktas automatiskt.
En PDF på upp till 50 MiB och 500 sidor. Extrahering är begränsad till 250 000 texttecken och 2 000 matchningar per sida, 10 miljoner tecken och 20 000 matchningar totalt, samt 2 000 anteckningar per sida. Resultaten bär en notis om begränsningar eller oläsbara sidor gör dem ofullständiga.
SNABB VIDEO-TUTORIAL
Hur man extraherar e-postadresser från en PDF
Förvandla utspridda kontaktuppgifter till en ren e-postlista.
Engelsk berättarröst
Se videon