Zhromažďovanie kontaktných adries
Zmeňte členský alebo podujatový adresár na zoznam s odkazmi na stránky.
Zmeňte kontaktné údaje vo vašom PDF na čistý zoznam e-mailov.
| Typ | Hodnota | Počet | Strany |
|---|
Kopírovanie a sťahovanie zahŕňa všetky zodpovedajúce riadky zo všetkých strán výsledkov. CSV obsahuje počty a čísla strán PDF; TXT obsahuje iba hodnoty.
Vyberte číslo strany vo výsledkoch a skontrolujte jej zdroj. Zvýraznenia zobrazujú približné pozície.
Váš zoznam je pripravený. Stiahnite si ho alebo sa vráťte späť, aby ste skontrolovali a zmenili formát.
Nahrajte dokument s textom, ktorý možno vybrať, alebo vyskúšajte ukážku.
Vyberte Extrahovať. Skontrolujte hodnoty, počty a zdrojové strany; filtrujte alebo zoraďte zoznam.
Skopírujte hodnoty alebo stiahnite CSV s odkazmi na strany či jednoduchý zoznam TXT.
Zmeňte vyberateľný text kontaktov v PDF na opakovane použiteľný e-mailový zoznam. Rozpoznané adresy zahŕňajú bežný e-mailový text a ciele odkazov mailto. Pred kopírovaním alebo stiahnutím skontrolujte počty a zdrojové stránky.
Zmeňte členský alebo podujatový adresár na zoznam s odkazmi na stránky.
Nájdite korešpondenčné adresy v dokumentoch, životopisoch alebo správach.
Zoskupte opakujúce sa adresy a skontrolujte, ako často sa vyskytujú.
Zhromažďujte adresy z textu a e-mailových odkazov.
Nástroj vyhľadáva konvenčné adresy v tvare local-part@domain, vrátane plusových značiek a bodkovaných mien. Prijíma internacionalizované názvy domén, ale nie ne-ASCII názvy schránok, citované lokálne časti alebo zámerne maskované adresy.
Pri odstraňovaní duplikátov sa adresy porovnávajú bez ohľadu na veľkosť písmen. Identická viditeľná adresa a cieľ mailto na tej istej strane sa nepočítajú dvakrát len preto, že text je klikateľný. Poškodené mapy znakov v PDF a adresy zalomené cez riadky môžu vyžadovať manuálnu kontrolu.
Skontrolujte počty, prejdite na stranu PDF a filtrujte zoznam výsledkov.
Každý výsledok zaznamenáva fyzickú pozíciu strany v PDF, ktorá sa môže líšiť od vytlačených čísel strán. Vyberte čip strany pre otvorenie náhľadu s približným zvýraznením.
Odstraňovanie duplikátov je predvolene zapnuté. Počty kombinujú rozpoznané opakovania tej istej hodnoty; vypnite túto možnosť, ak chcete vidieť samostatné výskyty. Triedenie podľa abecedy mení poradie zoznamu. Filtrovanie sa vzťahuje na kopírovanie a sťahovanie, ako aj na viditeľné riadky.
Zvoľte CSV pre počty a strany, alebo TXT pre jednu hodnotu na riadok.
CSV obsahuje stĺpce Typ, Hodnota, Počet a Strany. Kódovanie UTF-8 podporuje arabské a iné písma. Hodnoty, ktoré by mohli byť interpretované ako vzorce tabuľkového procesora, sú pre bezpečnejší import označené apostrofom.
TXT a Kopírovať všetko obsahujú iba hodnoty, jednu na riadok. Zahrnuté sú všetky riadky zodpovedajúce filtru, aj keď tabuľka na obrazovke zahŕňa niekoľko strán výsledkov. Nevytvára sa žiadne nové PDF a zdrojové PDF zostáva nezmenené.
Spracujte jedno PDF vo svojom prehliadači s explicitnými limitmi a upozorneniami na čiastočné výsledky.
Načítajte jedno PDF do veľkosti 50 MiB a 500 strán. Extrakcia kontroluje do 250 000 znakov a 2 000 zhôd na stranu, celkovo 10 miliónov znakov a 20 000 zhôd, a 2 000 anotácií na stranu. Rozpočet 90 sekúnd na extrakciu obmedzuje dlhé úlohy. Veľmi zložité dokumenty môžu fungovať lepšie, ak sú rozdelené na menšie súbory.
Keď sa dosiahne limit alebo stranu nie je možné úplne prečítať, výsledky zobrazia upozornenie a obmedzené alebo neúplné behy sa exportujú s označením partial v názve súboru. Strany bez vyberateľného textu sa počítajú osobitne. Pre skeny obsahujúce iba obrázky použite PDF OCR a potom sa vráťte k extrakcii rozpoznaného textu.
Obsah PDF sa spracováva lokálne v tomto prehliadači. Nahrané dokumenty sa neodosielajú na extrakčný server. Odkazy, e-mailové adresy a telefónne čísla nájdené v PDF sa nikdy automaticky nekontaktujú.
Otvorte jeden PDF súbor do 50 MB a 750 strán. Pre zložité dokumenty môžu platiť dodatočné limity pre výstup, pamäť a spracovanie.
Spracovanie prebieha vo vašom zariadení bez nahratia dokumentu. Výsledok si stiahnite pred zatvorením stránky; originál si ponechajte oddelene.
Vedzte, čo môžete očakávať, skôr než začnete.
Vo vašom zariadeníPremeňte vyberateľný kontaktný text v jednom PDF na zoznam e-mailov na opätovné použitie. Rozpoznané adresy zahŕňajú konvenčný e-mailový text a ciele odkazov mailto. Pred kopírovaním alebo stiahnutím skontrolujte počty a zdrojové strany. Skenované strany a maskované adresy ako meno [zavináč] priklad [bodka] org vyžadujú prípravu. Tento nástroj neoveruje doručiteľnosť, vlastníctvo ani súhlas s kontaktovaním kohokoľvek.
Číta sa iba vyberateľný text a rozpoznané ciele odkazov. Strany obsahujúce iba obrázky vyžadujú najprv PDF OCR. Spustite OCR, stiahnite si prehľadávateľné PDF a potom sa vráťte k tomuto extraktoru.
Odstránenie duplicít kombinuje rozpoznané ekvivalentné hodnoty. Počet zobrazuje zistené výskyty a Strany uvádzajú fyzické pozície strán v PDF. Vypnite túto možnosť, ak chcete ponechať výskyty oddelené. Vytlačený cieľ a zodpovedajúci klikateľný odkaz na tej istej strane sa nepočítajú dvakrát.
CSV obsahuje typ, hodnotu, počet výskytov a odkazy na strany. TXT a Kopírovať všetko poskytujú iba hodnoty, jednu na riadok. Zahrnuté sú všetky riadky zodpovedajúce aktuálnemu filtru, nielen viditeľná strana tabuľky.
Nie. Analýza PDF, vyhľadávanie zhôd a exporty prebiehajú v tomto prehliadači. Pôvodné PDF zostáva nezmenené. Žiadny extrahovaný odkaz, e-mail ani telefónne číslo nie sú automaticky kontaktované.
Jedno PDF do 50 MiB a 500 strán. Extrakcia je obmedzená na 250 000 textových znakov a 2 000 zhôd na stranu, celkovo 10 miliónov znakov a 20 000 zhôd, a 2 000 anotácií na stranu. Výsledky obsahujú upozornenie, ak sú kvôli limitom alebo nečitateľným stranám čiastočné.
RÝCHLY VIDEO NÁVOD
Ako extrahovať e-mailové adresy z PDF
Premeňte roztrúsené kontaktné údaje na prehľadný e-mailový zoznam.
Anglický komentár
Pozrieť video