Colectează linkuri sursă
Construiește o listă de referințe din rapoarte și documente de cercetare.
Scoate linkurile utile din PDF-ul tău.
| Tip | Valoare | Număr | Pagini |
|---|
Copierea și descărcarea includ toate rândurile potrivite, din fiecare pagină de rezultate. CSV include numărători și numerele paginilor PDF; TXT conține doar valorile.
Selectează un număr de pagină în Rezultate pentru a verifica sursa. Evidențierile arată pozițiile aproximative.
Lista ta este gata. Descarc-o sau revino pentru a verifica și schimba formatul.
Încarcă un document cu text selectabil sau încearcă exemplul.
Selectează Extrage. Verifică valorile, numărătorile și paginile sursă; filtrează sau sortează lista.
Copiază valorile sau descarcă CSV cu referințe de pagină ori o listă TXT simplă.
Colectează adrese HTTP/HTTPS imprimate, adrese www și ținte de linkuri web clicabile dintr-un PDF. Păstrează referințele paginilor și descarcă o listă deduplicată ca CSV sau TXT.
Construiește o listă de referințe din rapoarte și documente de cercetare.
Extrage destinațiile din spatele etichetelor de resurse clicabile.
Înregistrează unde a fost găsit fiecare link înainte de a-l revizui în altă parte.
Include o țintă de link chiar și atunci când eticheta sa spune doar „Citește mai mult”.
Linkurile imprimate care încep cu http://, https:// sau www. sunt recunoscute. Adnotările de link PDF pot dezvălui, de asemenea, ținte HTTP/HTTPS din spatele textului obișnuit. PDF-ul nu trebuie să afișeze neapărat URL-ul ca etichetă clicabilă.
Țintele imprimate și adnotările identice de pe o pagină nu sunt numărate dublu. Formele URL normalizate sunt utilizate pentru compararea duplicatelor, în timp ce prima scriere recunoscută este afișată. URL-urile lungi, fragmentate sau deteriorate pot necesita corecție manuală. Niciun URL extras nu este accesat automat.
Verifică numărătoarea, sari la o pagină PDF și filtrează lista de rezultate.
Fiecare rezultat înregistrează poziția fizică a paginii în PDF, care poate diferi de numerele paginilor imprimate. Selectează un cip de pagină pentru a deschide previzualizarea cu o evidențiere aproximativă.
Eliminarea duplicatelor este activată implicit. Numărătoarea combină repetițiile recunoscute ale aceleiași valori; dezactivează opțiunea pentru a vedea aparițiile separate. Sortarea alfabetică schimbă ordinea listei. Filtrarea se aplică atât copierii și descărcărilor, cât și rândurilor vizibile.
Alege CSV pentru numărători și pagini, sau TXT pentru o valoare pe linie.
CSV conține coloanele Tip, Valoare, Număr și Pagini. Codificarea UTF-8 suportă araba și alte scripturi. Valorile care ar putea fi interpretate ca formule de calcul tabelar sunt prefixate cu un apostrof pentru o importare mai sigură.
TXT și Copierea conțin doar valori, una pe linie. Toate rândurile care corespund filtrului sunt incluse, chiar și atunci când tabelul de pe ecran se întinde pe mai multe pagini de rezultate. Nu se creează niciun PDF nou, iar PDF-ul sursă rămâne neschimbat.
Procesează un PDF în browserul tău, cu limite explicite și notificări de rezultate parțiale.
Încarcă un PDF de până la 50 MiB și 500 de pagini. Extragerea verifică până la 250.000 de caractere și 2.000 de potriviri pe pagină, 10 milioane de caractere și 20.000 de potriviri în total, și 2.000 de adnotări pe pagină. Un buget de 90 de secunde pentru extragere limitează rulările lungi. Documentele foarte complexe pot funcționa mai bine dacă sunt împărțite în fișiere mai mici.
Când se atinge o limită sau o pagină nu poate fi citită complet, rezultatele afișează o notificare, iar rulările limitate sau eșuate se exportă cu mențiunea parțial în numele fișierului. Paginile fără text selectabil sunt numărate separat. Utilizează OCR PDF pentru scanări doar cu imagini, apoi revino pentru a extrage textul recunoscut.
Conținutul PDF este procesat local în acest browser. Documentele încărcate nu sunt trimise către un server de extragere. Linkurile, adresele de e-mail și numerele de telefon găsite în interiorul PDF-ului nu sunt niciodată contactate automat.
Deschideți un PDF de până la 50 MB și 750 pagini. Limite suplimentare de ieșire, memorie și procesare se pot aplica documentelor complexe.
Procesarea are loc pe dispozitivul dvs. fără a încărca documentul. Descărcați rezultatul înainte de a închide pagina; păstrați originalul separat.
Știți la ce să vă așteptați înainte de a începe.
Pe dispozitivul tăuColectați adrese HTTP/HTTPS tipărite, adrese www și ținte de link-uri web clicabile dintr-un PDF. Păstrați referințele paginilor și descărcați o listă deduplicată sub formă de CSV sau TXT. Instrumentul nu verifică dacă link-urile încă funcționează. Destinațiile interne ale paginilor, acțiunile JavaScript, mailto și alte scheme non-web nu sunt exportate ca link-uri web.
Sunt citite doar textul selectabil și țintele de link recunoscute. Paginile care conțin doar imagini necesită mai întâi OCR pentru PDF. Rulați OCR, descărcați PDF-ul care poate fi căutat, apoi reveniți la acest extractor.
Eliminarea duplicatelor combină valorile echivalente recunoscute. Coloana Count afișează aparițiile detectate, iar Pages listează pozițiile fizice ale paginilor din PDF. Dezactivați opțiunea pentru a păstra aparițiile separate. O țintă tipărită și un link clicabil corespondent pe aceeași pagină nu sunt numărate dublu.
CSV include tipul, valoarea, numărul de apariții și referințele paginilor. TXT și Copy all oferă doar valorile, una pe linie. Toate rândurile care corespund filtrului curent sunt incluse, nu doar pagina vizibilă a tabelului.
Nu. Analiza, potrivirea și exporturile PDF rulează în acest browser. PDF-ul original rămâne neschimbat. Niciun link, e-mail sau număr de telefon extras nu este contactat automat.
Un PDF de până la 50 MiB și 500 de pagini. Extracția este limitată la 250.000 de caractere text și 2.000 de potriviri pe pagină, 10 milioane de caractere și 20.000 de potriviri în total, și 2.000 de adnotări pe pagină. Rezultatele conțin o notificare dacă limitele sau paginile ilizibile le fac parțiale.
TUTORIAL VIDEO RAPID
Cum să extragi linkuri și URL-uri dintr-un PDF
Păstrează linkurile web utile fără a le deschide unul câte unul.
Narațiune în engleză
Urmărește videoclipul