Deschide Extrage linkuri dintr-un PDF pentru a colecta valori dintr-un PDF fără a le copia linie cu linie. Comparația folosește documentul eșantion real și un CSV descărcat din instrument. Exemplul de trei pagini produce 4 adrese web unice din 5 apariții.
Deschide PDF-ul tău
Încarcă un PDF sau selectează Încearcă eșantionul pentru a urmări acest exemplu. Previzualizarea PDF și miniaturile paginilor vor apărea. Fișierul tău original rămâne neschimbat, iar extragerea rulează în browserul tău.
Un director bazat pe text, un raport, o lucrare de cercetare sau o broșură reprezintă un punct de plecare util. Scanările care conțin doar imagini necesită OCR înainte ca textul imprimat să poată fi recunoscut.
Alege opțiunile utile
Pe un telefon, deschide Setări. Pe desktop, folosește panoul de setări de lângă previzualizare.
Păstrează Elimină duplicatele activat pentru a grupa țintele repetate. Alege CSV când ai nevoie de referințe la pagini sau TXT pentru o listă simplă de URL-uri. Exemplul folosește formatul CSV implicit și ordinea sursei.
Extrage și verifică potrivirile
Selectează Extrage. Când procesarea se termină, fila Rezultate arată valorile, numărul de apariții și paginile sursă. Selectează un număr de pagină circular pentru a inspecta locația sa în previzualizarea PDF, apoi revino la Rezultate.
Eșantionul include https://example.org/events de două ori și alte trei adrese web. De asemenea, demonstrează un link pe care se poate da clic, a cărui etichetă vizibilă este diferită de ținta sa. Un URL imprimat și ținta sa identică pe care se poate da clic pe aceeași pagină nu sunt numărate de două ori.
Folosește Filtrează rezultatele pentru a restrânge lista. Copierea și descărcarea includ toate rândurile potrivite, chiar și atunci când tabelul de rezultate se întinde pe mai multe ecrane de rânduri.
Descarcă CSV sau TXT
Selectează Descarcă CSV, apoi folosește butonul principal Descarcă de pe ecranul gata. CSV conține coloanele Tip, Valoare, Număr și Pagini. TXT și Copiază tot conțin o valoare pe linie.
Valorile CSV care ar putea fi interpretate ca formule de calcul tabelar sunt protejate cu un apostrof inițial. De exemplu, un număr de telefon internațional începe cu un semn plus. Folosește TXT dacă ai nevoie de o listă simplă fără protecție pentru calcul tabelar.
Întrebări frecvente
Poate acesta să găsească un link în spatele unor cuvinte precum „Citește mai mult”?
Da, atunci când acele cuvinte au o adnotare de link HTTP sau HTTPS acceptată în PDF. Valoarea exportată este destinația sa web. O subliniere vizuală singură nu dovedește existența unui link pe care se poate da clic.
Ce ar trebui să fac cu un PDF scanat?
Rulează PDF OCR mai întâi, apoi încarcă copia recunoscută în acest instrument. Verifică cu atenție rezultatul OCR: un caracter greșit poate schimba o adresă sau un identificator.
Care sunt limitele de extragere?
Folosește un PDF de până la 50 MiB și 750 pagini. Extragerea este limitată la 20,000 potriviri în total și 2,000 pe pagină, cu un buget de procesare de 90 secunde. Se aplică, de asemenea, limite de text și adnotări. Dacă o limită sau o pagină ilizibilă întrerupe scanarea, instrumentul afișează o notificare de rezultate parțiale și marchează numele fișierului de export ca parțial.
Linkurile mele PDF sunt deschise automat?
Nu. Extragerea citește fișierul în browser și nu vizitează destinațiile extrase. Butoanele de pagină navighează în cadrul previzualizării PDF.
Păstrează valorile și contextul lor
Extrage o listă concentrată, verifică paginile sursă și descarcă formatul care se potrivește următorului tău pas.

