Verktyg150

En användbar PDF-uppgift, förenklad

Extrahera telefonnummer från PDF.

Samla telefonnummer utan att kopiera dem ett i taget.

Advertisements
Din PDF-arbetsyta
På din enhet
eller släpp dina filer här
Din PDF bearbetas i denna webbläsare. PDF
Advertisements

Hur man extraherar telefonnummer från PDF

  1. 01

    Välj en PDF

    Ladda ett dokument med valbar text, eller prova exemplet.

  2. 02

    Extrahera och granska

    Välj Extrahera. Granska värden, antal och källsidor; filtrera eller sortera listan.

  3. 03

    Kopiera eller ladda ner

    Kopiera värdena, eller ladda ner CSV med sidreferenser eller en enkel TXT-lista.

BloggHur man extraherar telefonnummer från en PDFLäs guiden

Extrahera telefonnummer från PDF-kontaktlistor

Hitta identifierade telefonnummer i en PDF, gruppera upprepade format av samma nummer och behåll sidreferenser. Kopiera listan eller exportera den som CSV eller TXT.

Identifierade värden blir en lista med källsidereferenser.
SNABB VIDEO-TUTORIAL Hur man extraherar telefonnummer från en PDF Bygg en granskningsbar telefonlista med källsidorna bifogade. Engelsk berättarröst Se videon

Hur man extraherar telefonnummer från en PDF

När är detta användbart?

Kontaktlistor

Samla telefonuppgifter

Samla nummer från en PDF-katalog med deras källsidor.

Regionala dokument

Identifiera lokala format

Välj landet som används i en broschyr eller medlemslista.

Rensa

Gruppera upprepade nummer

Kombinera likvärdiga internationella och nationella format efter att ha valt en region.

Funktioner och kontroller

Välj internationell eller regional matchning

Börja med +landsnummer, eller välj det land som används av lokala kontakter.

Igenkänning av telefonnummer

Internationella nummer är standard. Välj ett land för att även tolka nationella format enligt landets numreringsregler. Igenkända anknytningar behålls, och likvärdiga format grupperas efter normaliserat internationellt nummer plus anknytning.

Matchningen kontrollerar landsspecifika nummerformat. Arabiska-indiska och persiska siffror normaliseras för matchning. Visade värden behåller en läsbar igenkänd form; detta är inte en tjänst för tillgänglighetskontroll eller omvänd sökning.

Granska värden med deras källsidor

Kontrollera antal, hoppa till en PDF-sida och filtrera resultatlistan.

Granska och organisera

Varje resultat registrerar den fysiska sidpositionen i PDF-filen, vilket kan skilja sig från tryckta sidnummer. Välj en sidmarkör för att öppna förhandsgranskningen med en ungefärlig markering.

Ta bort dubbletter är aktiverat som standard. Antal kombinerar igenkända upprepningar av samma värde; stäng av för att se separata förekomster. Sortera alfabetiskt ändrar listans ordning. Filtrering gäller både kopiering och nedladdningar samt de synliga raderna.

Kopiera värden eller ladda ner en strukturerad lista

Välj CSV för antal och sidor, eller TXT för ett värde per rad.

Vad varje nedladdning innehåller

CSV innehåller kolumnerna Typ, Värde, Antal och Sidor. UTF-8-kodning stöder arabiska och andra skript. Värden som kan tolkas som kalkylbladsformler föregås av en apostrof för säkrare import.

TXT och Kopiera alla innehåller endast värden, ett per rad. Alla rader som matchar filtret inkluderas, även när tabellen på skärmen sträcker sig över flera resultatsidor. Ingen ny PDF skapas och käll-PDF-filen förblir oförändrad.

Håll stora extraheringar hanterbara

Bearbeta en PDF i din webbläsare, med explicita gränser och meddelanden om partiella resultat.

Filer, gränser och skannade sidor

Ladda en PDF på upp till 50 MiB och 500 sidor. Extraheringen kontrollerar upp till 250 000 tecken och 2 000 matchningar per sida, 10 miljoner tecken och 20 000 matchningar totalt, samt 2 000 anteckningar per sida. En tidsbudget på 90 sekunder begränsar långa körningar. Mycket komplexa dokument kan fungera bättre om de delas upp i mindre filer.

När en gräns nås eller en sida inte kan läsas fullständigt, visar resultaten ett meddelande och begränsade eller misslyckade körningar exporteras med partial i filnamnet. Sidor utan valbar text räknas separat. Använd PDF OCR för bildbaserade skanningar, återvänd sedan för att extrahera den igenkända texten.

PDF-innehåll bearbetas lokalt i denna webbläsare. Uppladdade dokument skickas inte till en extraheringsserver. Länkar, e-postadresser och telefonnummer som hittas i PDF-filen kontaktas aldrig automatiskt.

Filer och bearbetning som stöds

Indata
PDF
Utdata
CSV / TXT

Öppna en PDF på upp till 50 MB och 750 sidor. Ytterligare begränsningar för utdata, minne och bearbetning kan gälla för komplexa dokument.

Bearbetningen sker på din enhet utan att dokumentet laddas upp. Ladda ner resultatet innan du stänger sidan; spara originalet separat.

Advertisements
Vanliga frågor

Några användbara svar

Vet vad du kan förvänta dig innan du börjar.

På din enhet
Vad kan det här verktyget känna igen?

Hitta igenkända telefonnummer i en PDF, gruppera upprepade format av samma nummer och behåll sidreferenser. Kopiera listan eller exportera den som CSV eller TXT. Validering av nummerformat kan inte bekräfta att en linje existerar eller är nåbar. Välj en region för nationella nummer. Kortnummer, OCR-fel och tvetydig numerisk text kan missas.

Kan jag extrahera data från skannade PDF-filer?

Endast valbar text och identifierade länkmål läses. Sidor som endast består av bilder behöver först PDF-OCR. Kör OCR, ladda ner den sökbara PDF-filen och återvänd sedan till denna extraktor.

Hur hanteras dubbletter och antal?

Ta bort dubbletter kombinerar identifierade likvärdiga värden. Antal visar upptäckta förekomster och Sidor listar fysiska PDF-sidpositioner. Inaktivera alternativet för att behålla förekomster separata. Ett utskrivet mål och en matchande klickbar länk på samma sida räknas inte dubbelt.

Vad är skillnaden mellan CSV och TXT?

CSV inkluderar typ, värde, antal förekomster och sidreferenser. TXT och Kopiera alla tillhandahåller endast värden, ett per rad. Alla rader som matchar det aktuella filtret inkluderas, inte bara den synliga tabellsidan.

Laddas PDF-filen upp för extrahering?

Nej. PDF-tolkning, matchning och export körs i denna webbläsare. Den ursprungliga PDF-filen förblir oförändrad. Ingen extraherad länk, e-postadress eller telefonnummer kontaktas automatiskt.

Vilka är begränsningarna?

En PDF på upp till 50 MiB och 500 sidor. Extrahering är begränsad till 250 000 texttecken och 2 000 matchningar per sida, 10 miljoner tecken och 20 000 matchningar totalt, samt 2 000 anteckningar per sida. Resultaten bär en notis om begränsningar eller oläsbara sidor gör dem ofullständiga.

Fortsätt

Vad vill du göra härnäst?

Välj ett verktyg. Din färdiga PDF följer med dig.

PDF

Advertisements

Språk38

English العربية Français Italiano Deutsch Español Português Nederlands Русский Türkçe 日本語 中文 हिन्दी Bahasa Indonesia Bahasa Melayu 한국어 Tiếng Việt ไทย Polski Svenska Українська Norsk বাংলা Ελληνικά فارسی اردو Čeština Dansk Magyar Română Suomi Български Filipino ქართული Slovenčina Azərbaycanca עברית Slovenščina