Quelllinks sammeln
Erstellen Sie eine Referenzliste aus Berichten und Forschungsdokumenten.
Holen Sie die nützlichen Links aus Ihrem PDF.
| Typ | Wert | Anzahl | Seiten |
|---|
Kopieren und Herunterladen umfassen alle passenden Zeilen über alle Ergebnisseiten hinweg. CSV enthält Anzahlen und PDF-Seitenzahlen; TXT enthält nur die Werte.
Wählen Sie eine Seitenzahl in den Ergebnissen, um die Quelle zu prüfen. Hervorhebungen zeigen ungefähre Positionen.
Ihre Liste ist bereit. Laden Sie sie herunter oder gehen Sie zurück, um das Format zu überprüfen und zu ändern.
Laden Sie ein Dokument mit markierbarem Text oder probieren Sie das Beispiel aus.
Wählen Sie Extrahieren. Überprüfen Sie Werte, Anzahl und Quellseiten; filtern oder sortieren Sie die Liste.
Kopieren Sie die Werte oder laden Sie eine CSV mit Seitenreferenzen oder eine einfache TXT-Liste herunter.
Sammeln Sie gedruckte HTTP/HTTPS-Adressen, www-Adressen und anklickbare Weblink-Ziele aus einem PDF. Behalten Sie Seitenreferenzen bei und laden Sie eine deduplizierte Liste als CSV oder TXT herunter.
Erstellen Sie eine Referenzliste aus Berichten und Forschungsdokumenten.
Extrahieren Sie die Ziele hinter anklickbaren Ressourcen-Labels.
Notieren Sie, wo jeder Link gefunden wurde, bevor Sie ihn anderswo überprüfen.
Link-Ziel einbeziehen, auch wenn das Label nur „Weiterlesen“ lautet.
Gedruckte Links, die mit http://, https:// oder www. beginnen, werden erkannt. PDF-Link-Anmerkungen können auch HTTP/HTTPS-Ziele hinter gewöhnlichem Text aufdecken. Das PDF muss die URL nicht als anklickbares Label anzeigen.
Identische gedruckte Ziele und Anmerkungen auf einer Seite werden nicht doppelt gezählt. Für den Duplikatsvergleich werden normalisierte URL-Formen verwendet, während die erste erkannte Schreibweise angezeigt wird. Lange, umgebrochene oder beschädigte URLs erfordern möglicherweise eine manuelle Korrektur. Keine extrahierte URL wird automatisch aufgerufen.
Anzahl prüfen, zu einer PDF-Seite springen und die Ergebnisliste filtern.
Jedes Ergebnis erfasst die physische Seitenposition im PDF, die von gedruckten Seitenzahlen abweichen kann. Wählen Sie einen Seiten-Chip, um die Vorschau mit einer ungefähren Markierung zu öffnen.
„Duplikate entfernen“ ist standardmäßig aktiviert. Die Anzahl kombiniert erkannte Wiederholungen desselben Wertes; schalten Sie dies aus, um separate Vorkommen zu sehen. „Alphabetisch sortieren“ ändert die Reihenfolge der Liste. Die Filterung gilt sowohl für das Kopieren und Herunterladen als auch für die sichtbaren Zeilen.
Wählen Sie CSV für Anzahl und Seiten oder TXT für einen Wert pro Zeile.
CSV enthält die Spalten Typ, Wert, Anzahl und Seiten. Die UTF-8-Kodierung unterstützt Arabisch und andere Schriften. Werte, die als Tabellenkalkulationsformeln interpretiert werden könnten, werden für einen sichereren Import mit einem Apostroph versehen.
TXT und „Alle kopieren“ enthalten nur Werte, einen pro Zeile. Alle Zeilen, die dem Filter entsprechen, sind enthalten, auch wenn die Tabelle auf dem Bildschirm mehrere Ergebnisseiten umfasst. Es wird kein neues PDF erstellt und das Quell-PDF bleibt unverändert.
Verarbeiten Sie ein PDF in Ihrem Browser mit expliziten Limits und Hinweisen auf Teilergebnisse.
Laden Sie ein PDF mit bis zu 50 MiB und 500 Seiten. Die Extraktion prüft bis zu 250.000 Zeichen und 2.000 Übereinstimmungen pro Seite, insgesamt 10 Millionen Zeichen und 20.000 Übereinstimmungen sowie 2.000 Anmerkungen pro Seite. Ein Extraktionsbudget von 90 Sekunden begrenzt lange Durchläufe. Sehr komplexe Dokumente funktionieren möglicherweise besser, wenn sie in kleinere Dateien aufgeteilt werden.
Wenn ein Limit erreicht wird oder eine Seite nicht vollständig gelesen werden kann, zeigen die Ergebnisse einen Hinweis an, und begrenzte oder fehlgeschlagene Durchläufe werden mit „partial“ im Dateinamen exportiert. Seiten ohne auswählbaren Text werden separat gezählt. Verwenden Sie PDF-OCR für reine Bildscans und kehren Sie dann zurück, um den erkannten Text zu extrahieren.
PDF-Inhalte werden lokal in diesem Browser verarbeitet. Hochgeladene Dokumente werden nicht an einen Extraktionsserver gesendet. Links, E-Mail-Adressen und Telefonnummern, die im PDF gefunden werden, werden niemals automatisch kontaktiert.
Öffnen Sie ein PDF mit bis zu 50 MB und 750 Seiten. Für komplexe Dokumente können zusätzliche Ausgabe-, Speicher- und Verarbeitungsgrenzen gelten.
Die Verarbeitung erfolgt auf Ihrem Gerät, ohne das Dokument hochzuladen. Laden Sie Ihr Ergebnis herunter, bevor Sie die Seite schließen; bewahren Sie das Original separat auf.
Wissen Sie, was Sie erwartet, bevor Sie beginnen.
Auf deinem GerätSammeln Sie gedruckte HTTP/HTTPS-Adressen, www-Adressen und anklickbare Weblink-Ziele aus einer PDF. Behalten Sie Seitenverweise bei und laden Sie eine deduplizierte Liste als CSV oder TXT herunter. Das Tool prüft nicht, ob Links noch funktionieren. Interne Seitenziele, JavaScript-Aktionen, mailto- und andere Nicht-Web-Schemata werden nicht als Weblinks exportiert.
Nur auswählbarer Text und erkannte Link-Ziele werden gelesen. Seiten, die nur aus Bildern bestehen, benötigen zuerst eine PDF-OCR. Führen Sie OCR aus, laden Sie die durchsuchbare PDF herunter und kehren Sie dann zu diesem Extraktor zurück.
„Duplikate entfernen“ kombiniert erkannte äquivalente Werte. Die Anzahl zeigt die erkannten Vorkommen und „Seiten“ listet die physischen PDF-Seitenpositionen auf. Deaktivieren Sie die Option, um Vorkommen getrennt zu halten. Ein gedrucktes Ziel und ein passender anklickbarer Link auf derselben Seite werden nicht doppelt gezählt.
CSV enthält Typ, Wert, Vorkommensanzahl und Seitenverweise. TXT und „Alle kopieren“ liefern nur die Werte, einen pro Zeile. Alle Zeilen, die dem aktuellen Filter entsprechen, werden einbezogen, nicht nur die sichtbare Tabellenseite.
Nein. PDF-Parsing, Abgleich und Exporte laufen in diesem Browser. Das ursprüngliche PDF bleibt unverändert. Kein extrahierter Link, keine E-Mail-Adresse und keine Telefonnummer wird automatisch kontaktiert.
Eine PDF bis zu 50 MiB und 500 Seiten. Die Extraktion ist auf 250.000 Textzeichen und 2.000 Treffer pro Seite, 10 Millionen Zeichen und 20.000 Treffer insgesamt sowie 2.000 Anmerkungen pro Seite begrenzt. Die Ergebnisse enthalten einen Hinweis, falls Limits oder unlesbare Seiten sie unvollständig machen.
KURZE VIDEOANLEITUNG
Wie man Links und URLs aus einem PDF extrahiert
Behalten Sie die nützlichen Weblinks, ohne sie einzeln zu öffnen.
Englische Erzählung
Video ansehen