Nástroje150

PRAKTICKÝ PRŮVODCE PDF

Jak extrahovate-mailové adresy z PDF

Proměňte roztroušené kontaktní údaje v čistý e-mailový seznam.

Třístránková ukázka vytvoří 2 unikátní e-mailové adresy ze 4 výskytů.

Postupujte podle příručky
PŘÍKLAD REÁLNÉHO NÁSTROJE
Strana PDFStrana ze skutečného ukázkového PDF
Extrahované hodnotyHodnoty a odkazy na strany ze skutečného staženého CSV
Tři ukázkové strany se změní na 2 unikátní e-mailové adresy, každá s počtem výskytů a zdrojovými stranami.
Advertisements
RYCHLÝ VIDEO TUTORIÁL Jak extrahovat e-mailové adresy z PDF Proměňte roztroušené kontaktní údaje v čistý e-mailový seznam. Anglický komentář Sledovat video

Jak extrahovat e-mailové adresy z PDF

Advertisements

Otevřete Extrakce e-mailů z PDF pro sběr hodnot z jednoho PDF bez nutnosti kopírování řádek po řádku. Porovnání využívá skutečný ukázkový dokument a CSV stažené z nástroje. Třístránková ukázka vytvoří 2 unikátní e-mailové adresy ze 4 výskytů.

01

Otevřete své PDF

Nahrajte jedno PDF nebo vyberte Vyzkoušet ukázku pro sledování tohoto příkladu. Zobrazí se náhled PDF a miniatury stran. Váš původní soubor zůstane nezměněn a extrakce proběhne ve vašem prohlížeči.

Textový adresář, zpráva, výzkumná práce nebo brožura jsou užitečným výchozím bodem. Skenované dokumenty obsahující pouze obrázky vyžadují před rozpoznáním textu OCR.

02

Zvolte užitečné možnosti

Na telefonu otevřete Nastavení. Na počítači použijte panel nastavení vedle náhledu.

Ponechte Odstranit duplicity zapnuté. Zapněte Seřadit abecedně, pokud chcete mít seznam kontaktů seřazený podle adresy. Pro tento příklad ponechte výchozí pořadí zdrojů a formát CSV.

03

Extrahujte a zkontrolujte shody

Vyberte Extrahovat. Po dokončení zpracování karta Výsledky zobrazí hodnoty, počty výskytů a zdrojové strany. Vyberte číslo strany v kroužku pro kontrolu jejího umístění v náhledu PDF, poté se vraťte k výsledkům.

Ukázka vrací events@example.org na stranách 1 a 3, a research@example.org na stranách 1 a 2. Každá adresa se v deduplikovaném seznamu objeví jednou s počtem 2. Vypněte odstranění duplicit, pokud potřebujete každý výskyt jako samostatný řádek.

Použijte Filtrovat výsledky pro zúžení seznamu. Kopírování a stahování zahrnuje všechny odpovídající řádky, i když tabulka výsledků přesahuje několik obrazovek.

04

Stáhněte CSV nebo TXT

Vyberte Stáhnout CSV, poté použijte hlavní tlačítko Stáhnout na obrazovce připravenosti. CSV obsahuje sloupce Typ, Hodnota, Počet a Stránky. TXT a Kopírovat vše obsahují jednu hodnotu na řádek.

Hodnoty v CSV, které by mohly být interpretovány jako vzorce tabulkového procesoru, jsou chráněny úvodním apostrofem. Například mezinárodní telefonní číslo začíná znaménkem plus. Použijte TXT, pokud potřebujete prostý seznam bez ochrany tabulkového procesoru.

PÁR UŽITEČNÝCH PODROBNOSTÍ

Časté dotazy

Mohu seznam použít přímo v e-mailingovém nástroji?

Kopírovat vše nebo TXT poskytne jednu adresu na řádek. CSV navíc uchovává počty a odkazy na strany. Před importem do jiného systému zkontrolujte seznam a důvod, proč kontaktujete jeho vlastníky.

Co mám dělat se skenovaným PDF?

Nejprve spusťte PDF OCR, poté načtěte rozpoznanou kopii do tohoto nástroje. Pečlivě zkontrolujte výstup OCR: chybný znak může změnit adresu nebo identifikátor.

Jaké jsou limity extrakce?

Použijte jedno PDF do velikosti 50 MiB a 750 stran. Extrakce je omezena na 20 000 shod celkem a 2 000 na stranu, s časovým limitem zpracování 90 sekund. Platí také limity pro text a anotace. Pokud limit nebo nečitelná strana přeruší skenování, nástroj zobrazí upozornění na částečné výsledky a označí název exportovaného souboru jako částečný.

Otevírají se mé odkazy z PDF automaticky?

Ne. Extrakce čte soubor v prohlížeči a nenavštěvuje extrahované cíle. Tlačítka stránek slouží k navigaci v náhledu PDF.

ŘADA JE NA VÁS

Ponechte si hodnoty i jejich kontext

Extrahujte cílený seznam, zkontrolujte zdrojové strany a stáhněte formát, který vyhovuje vašemu dalšímu kroku.

Otevřete Extrakce e-mailů z PDF

Detail obrázku

Advertisements

Jazyk38

English العربية Français Italiano Deutsch Español Português Nederlands Русский Türkçe 日本語 中文 हिन्दी Bahasa Indonesia Bahasa Melayu 한국어 Tiếng Việt ไทย Polski Svenska Українська Norsk বাংলা Ελληνικά فارسی اردو Čeština Dansk Magyar Română Suomi Български Filipino ქართული Slovenčina Azərbaycanca עברית Slovenščina